Ce que fait ce modèle
Le modèle gemini-2.5-flash-preview-tts est une déclinaison de la famille Gemini de Google, spécialisée dans la synthèse vocale (Text-to-Speech) et la génération audio. Ce modèle en version préliminaire ("preview") est conçu pour offrir une exécution rapide et une grande fluidité dans la transformation de textes en signaux audio.
Ses applications principales englobent l'assistance vocale interactive, la lecture de documents et la production de contenus audio dynamiques. Il est particulièrement adapté aux scénarios exigeant une faible latence de réponse et une intégration directe des capacités audio.
S'agissant d'une version de prévisualisation, il est recommandé de surveiller la stabilité du service pour les usages critiques. Les tarifs d'utilisation sur la plateforme s'élèvent à 0,50 $ pour l'entrée et 10,00 $ pour la sortie.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Synthèse vocale
Type principal de contenu traité ou produit par ce modèle.
Synthèse vocale
Transforme du texte en parole.
Audio
Traite ou produit de l'audio (voix, musique, effets).
Historique des versions
5 versions reconstituées à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Gemini 3.8 Flash TTS
Dernière versiongoogle:gemini-3.8-flash-ttsModèle de synthèse vocale conçu pour convertir du texte en flux audio avec une faible latence.
Synthèse vocaleAudio- Fournisseur
- Type principal
- Synthèse vocale (TTS)
- Modalité d'entrée
- Texte
- Modalité de sortie
- Audio
Tarif annoncé : 0.50 $ en entrée, 9.00 $ en sortie, par million de jetons (USD)
- Date non communiquée
Gemini 3.8 Flash-Lite TTS
google:gemini-3.8-flash-lite-ttsModèle de synthèse vocale conçu pour convertir des entrées textuelles en flux audio avec une latence optimisée.
- Tâche principale
- Synthèse vocale (TTS)
- Modalité d'entrée
- Texte
- Modalité de sortie
- Audio
Tarif annoncé : 0.50 $ en entrée, 6.00 $ en sortie, par million de jetons (USD)
- Date non communiquée
Gemini 3.1 Flash TTS (Preview)
google:gemini-3.1-flash-tts-previewModèle de synthèse vocale conçu par Google pour générer des flux audio fluides et naturels à partir de textes, optimisé pour la rapidité d'exécution.
- Fournisseur
- Identifiant
- gemini-3.1-flash-tts-preview
- Type principal
- Text-to-Speech (TTS)
- Capacités
- Soutien TTS et génération audio
- Tarif Entrée
- 30,00 $
- Tarif Sortie
- 50,00 $
- Statut
- Version préliminaire (Preview)
Tarif annoncé : 1.00 $ en entrée, 20.00 $ en sortie, par million de jetons (USD)
- Date non communiquée
Gemini 2.5 Pro Preview (TTS)
google:gemini-2.5-pro-preview-ttsModèle de prévisualisation de Google dédié à la synthèse vocale (TTS), conçu pour la génération d'audio de haute qualité à partir de contenus textuels.
- Fournisseur
- Type principal
- Synthèse vocale (TTS)
- Capacités prises en charge
- Synthèse vocale (TTS), Audio
- Tarif Entrée
- 1,00 $
- Tarif Sortie
- 20,00 $
Tarif annoncé : 1.00 $ en entrée, 20.00 $ en sortie, par million de jetons (USD)
- Date non communiquée
Gemini 2.5 Flash Preview TTS
google:gemini-2.5-flash-preview-tts- Fournisseur
- Identifiant
- gemini-2.5-flash-preview-tts
- Type principal
- Text-to-Speech (TTS)
- Capacités
- Synthèse vocale (supports_tts), Traitement audio (supports_audio)
- Tarif Entrée
- 0,50 $
- Tarif Sortie
- 10,00 $
Tarif annoncé : 0.50 $ en entrée, 10.00 $ en sortie, par million de jetons (USD)