Ce que fait ce modèle
Le modèle Qwen3-ASR-1.7B est une solution compacte et spécialisée dans la reconnaissance vocale automatique (ASR) et la transcription de l'audio vers le texte (Speech-to-Text). Avec ses 1,7 milliard de paramètres, il est conçu pour offrir un traitement rapide et efficace des flux vocaux, constituant une option intéressante pour les tâches de transcription nécessitant une faible latence.
Disponible via l'API d'OpenRouter, son modèle de tarification est fixé à 7,50 $ USD par million de jetons pour les données audio entrantes, tandis que la sortie textuelle générée est entièrement gratuite. Cette structure s'avère particulièrement avantageuse pour le traitement de volumes importants d'enregistrements.
Sur le plan de la souveraineté, l'usage de ce modèle tiers implique le transit des données vocales par les serveurs d'OpenRouter. Pour les institutions et entreprises québécoises encadrées par des règles strictes de gouvernance des données (telles que la Loi 25), il est recommandé de limiter son utilisation aux données publiques ou de procéder à une évaluation de conformité avant tout traitement d'informations sensibles.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Reconnaissance vocale
Type principal de contenu traité ou produit par ce modèle.
Reconnaissance vocale
Transcrit la parole en texte.
Audio
Traite ou produit de l'audio (voix, musique, effets).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Qwen3 ASR 1.7B
Dernière versionqwen/qwen3-asr-1.7bReconnaissance vocaleAudio- Type principal
- Transcription (STT)
- Taille du modèle
- 1,7 milliard de paramètres
- Tarif Entrée
- 7,50 $ / million de jetons
- Tarif Sortie
- 0,00 $
- Format d'entrée
- Audio / Vocal
Tarif annoncé : 7.50 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)