Ce que fait ce modèle
Kokoro-82M est un modèle de synthèse vocale (Text-to-Speech) ouvert et extrêmement compact développé par hexgrad. Avec seulement 82 millions de paramètres, il se distingue par sa rapidité d'exécution et sa faible latence, tout en délivrant une qualité audio fluide et naturelle.
Dans le cadre de ProductivIA, ce modèle permet d'intégrer des fonctionnalités de lecture à haute voix, d'assistance interactive ou de rétroaction vocale avec une efficacité énergétique et financière remarquable. Son architecture légère en fait une option de choix pour optimiser les coûts opérationnels des organisations québécoises tout en maintenant des performances de pointe.
Points de vigilance : Il est recommandé de valider la prononciation des régionalismes et des expressions propres au français québécois selon les voix disponibles. Le coût est calculé en fonction du nombre de caractères envoyés en entrée.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Synthèse vocale
Type principal de contenu traité ou produit par ce modèle.
Synthèse vocale
Transforme du texte en parole.
Audio
Traite ou produit de l'audio (voix, musique, effets).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Kokoro 82M
Dernière versionhexgrad/kokoro-82mSynthèse vocaleAudio- Type de modèle
- Synthèse vocale (TTS)
- Taille du modèle
- 82 millions de paramètres
- Tarif Entrée
- 0,62 $ / million de caractères
- Tarif Sortie
- 0,00 $
- Fournisseur
- OpenRouter (hexgrad)
Tarif annoncé : 4.00 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)