Ce que fait ce modèle
Le modèle Whisper-1 est la solution de référence de l'éditeur OpenAI pour les tâches de transcription et de reconnaissance vocale (Speech-to-Text). Grâce à ses capacités de traitement de l'audio, il permet de convertir efficacement la parole en texte écrit avec une grande tolérance aux variations d'accents et aux bruits de fond.
Ce modèle est principalement indiqué pour la transcription de réunions, la création de sous-titres ou l'indexation de contenus sonores. L'intégration s'effectue via l'infrastructure d'OpenAI, ce qui implique un traitement externe des données vocales ; un point de vigilance à considérer pour les organisations québécoises ayant des exigences strictes en matière de souveraineté des données et de cadre réglementaire local.
Sur la plateforme, l'accès à ce modèle est configuré avec un tarif d'entrée de 30 $ et un tarif de sortie de 50 $.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Reconnaissance vocale
Type principal de contenu traité ou produit par ce modèle.
Reconnaissance vocale
Transcrit la parole en texte.
Audio
Traite ou produit de l'audio (voix, musique, effets).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Whisper-1
Dernière versionopenai:whisper-1Reconnaissance vocaleAudio- Fournisseur
- OpenAI
- Identifiant
- whisper-1
- Type de service
- Speech-to-Text (STT)
- Capacités supportées
- supports_stt, supports_audio
- Tarif Entrée
- 30 $
- Tarif Sortie
- 50 $
Tarif annoncé : 0.01 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)