Reconnaissance vocale

Qwen

Qwen3 Asr 1.7B

Modèle d'Asie spécialisé dans la transcription audio (STT) de 1,7 milliard de paramètres, accessible de manière flexible via OpenRouter.

Dernière version
qwen/qwen3-asr-1.7b
Numéro de version
1.7
Type
Reconnaissance vocale
Versions recensées
1

Ce que fait ce modèle

Le modèle Qwen3-ASR-1.7B est une solution compacte et spécialisée dans la reconnaissance vocale automatique (ASR) et la transcription de l'audio vers le texte (Speech-to-Text). Avec ses 1,7 milliard de paramètres, il est conçu pour offrir un traitement rapide et efficace des flux vocaux, constituant une option intéressante pour les tâches de transcription nécessitant une faible latence.

Disponible via l'API d'OpenRouter, son modèle de tarification est fixé à 7,50 $ USD par million de jetons pour les données audio entrantes, tandis que la sortie textuelle générée est entièrement gratuite. Cette structure s'avère particulièrement avantageuse pour le traitement de volumes importants d'enregistrements.

Sur le plan de la souveraineté, l'usage de ce modèle tiers implique le transit des données vocales par les serveurs d'OpenRouter. Pour les institutions et entreprises québécoises encadrées par des règles strictes de gouvernance des données (telles que la Loi 25), il est recommandé de limiter son utilisation aux données publiques ou de procéder à une évaluation de conformité avant tout traitement d'informations sensibles.

Capacités

Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.

Reconnaissance vocale

Type principal de contenu traité ou produit par ce modèle.

Reconnaissance vocale

Transcrit la parole en texte.

Audio

Traite ou produit de l'audio (voix, musique, effets).

Historique des versions

1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.

  1. Date non communiquée

    Qwen3 ASR 1.7B

    Dernière version

    qwen/qwen3-asr-1.7b

    Reconnaissance vocaleAudio
    Type principal
    Transcription (STT)
    Taille du modèle
    1,7 milliard de paramètres
    Tarif Entrée
    7,50 $ / million de jetons
    Tarif Sortie
    0,00 $
    Format d'entrée
    Audio / Vocal

    Tarif annoncé : 7.50 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)

Liste de modèles fournie par la plateforme ProductivIA

productivia.ca