Ce que fait ce modèle
Le modèle qwen/qwen-audio-3.0-tts-flash est une solution de synthèse vocale (Text-to-Speech) optimisée pour la vitesse et l'efficacité, disponible via l'API OpenRouter. Conçu pour des performances en temps réel, ce modèle convertit des textes en énoncés audio clairs et naturels avec une latence minimale.
Dans le cadre de la souveraineté numérique et de la résilience technologique des organisations québécoises, l'accès à ce modèle par l'intermédiaire d'OpenRouter permet de diversifier les options technologiques. Cette approche multi-fournisseur renforce l'autonomie en évitant la dépendance exclusive à un nombre restreint de plateformes propriétaires.
Points de vigilance : La tarification repose sur un modèle asymétrique, avec un coût de 15,00 $ par million de jetons en entrée et une gratuité sur le volume de sortie. Bien que le modèle prenne en charge le traitement multilingue, il est conseillé de valider la prononciation des régionalismes et des accents locaux lors des phases d'intégration.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Synthèse vocale
Type principal de contenu traité ou produit par ce modèle.
Synthèse vocale
Transforme du texte en parole.
Audio
Traite ou produit de l'audio (voix, musique, effets).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Qwen Audio 3.0 TTS Flash
Dernière versionqwen/qwen-audio-3.0-tts-flashSynthèse vocaleAudio- Fournisseur
- OpenRouter
- Identifiant
- qwen/qwen-audio-3.0-tts-flash
- Type principal
- Synthèse vocale (TTS)
- Coût d'entrée
- 15,00 $ / million de jetons
- Coût de sortie
- Gratuit (0,00 $)
- Capacités
- Synthèse vocale, audio
Tarif annoncé : 15.00 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)