Ce que fait ce modèle
Le modèle microsoft/mai-voice-2 est une solution spécialisée dans la synthèse vocale (Text-to-Speech) développée par Microsoft. Accessible via la plateforme OpenRouter, il permet de convertir des textes en énoncés audio réalistes, répondant aux besoins d'accessibilité, d'audioguides ou d'assistants conversationnels.
La tarification sur OpenRouter est structurée à 22,00 $ par million d'unités en entrée (requête textuelle) et gratuite en sortie (génération audio). Le modèle prend nativement en charge la génération de flux audio à partir d'instructions textuelles.
Dans le cadre d'un déploiement via les infrastructures de ProductivIA / Matania, l'utilisation de cette API tierce est encadrée afin de respecter les exigences de souveraineté numérique et de gouvernance des données du Québec, tout en offrant une flexibilité d'intégration technologique.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Synthèse vocale
Type principal de contenu traité ou produit par ce modèle.
Synthèse vocale
Transforme du texte en parole.
Audio
Traite ou produit de l'audio (voix, musique, effets).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
MAI Voice 2
Dernière versionmicrosoft/mai-voice-2Synthèse vocaleAudio- Type de modèle
- Synthèse vocale (TTS)
- Coût d'entrée
- 22,00 $ / million de tokens
- Coût de sortie
- 0,00 $
- Capacités
- Audio, Synthèse vocale (supports_tts)
Tarif annoncé : 22.00 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)