Observatoire Québec
Modèles d'intelligence artificielle
La dernière version de chaque famille de modèles recensée, avec ses capacités, son fournisseur et son historique complet.
- Familles de modèles
- 567
- Versions recensées
- 805
- Fournisseurs
- 87
- Mise à jour
- 25 septembre 2026
20 modèles affichés, classés de la sortie la plus récente à la plus ancienne
Cohere Transcribe 03 2026
Modèle de transcription de la parole en texte (STT) de Cohere, adapté aux exigences de traitement souverain et sécurisé des données au Québec.
Qwen3 Asr Flash
Le modèle de reconnaissance vocale qwen3-asr-flash-2026-02-10 d'Alibaba : capacités, performances, tarifs et intégration via OpenRouter.
Nova 3
Modèle de transcription vocale (STT) de pointe, offrant une rapidité d'exécution et une précision accrue pour les flux audio complexes.
Chirp 3
Google Chirp 3, le modèle ASR de pointe de Google Cloud, désormais disponible pour la transcription audio-vers-texte sur OpenRouter.
Gemini Transcribe
L’identifiant gemini-3.5-transcribe et étude de Gemini 3.5 Flash, le modèle multimodal de référence de Google pour la transcription avancée.
GPT Live Transcribe
Décryptage de l'identifiant gpt-live-transcribe, à la croisée des technologies GPT-Realtime-Whisper et GPT-Live d'OpenAI.
GPT Realtime Whisper
Modèle de transcription audio en temps réel (Speech-to-Text) par OpenAI, conçu pour convertir instantanément des flux de parole en texte écrit.
GPT Transcribe
Le modèle spécialisé d'OpenAI conçu pour la transcription précise de fichiers audio finalisés et de sessions Realtime.
Mai Transcribe 1.5
Modèle de transcription audio (Speech-to-Text) développé par Microsoft, conçu pour convertir la parole en texte de manière performante et économique via OpenRouter.
Mai Transcribe 2
Modèle de reconnaissance vocale de Microsoft, proposé via OpenRouter pour la transcription efficace de contenus audio en texte à un coût d'entrée très compétitif.
Muse Voice Transcribe 1.0
Meta lance Muse Voice Transcribe 1.0, un modèle de reconnaissance vocale et de diarisation temps réel combinant streaming adaptatif et haute précision.
Nemotron 3.5 Asr Streaming Multilingual 0.6B
Modèle d'ASR multilingue ultra-léger conçu par NVIDIA pour la transcription audio en temps réel et à faible latence via OpenRouter.
Parakeet Tdt 0.6B V3
Modèle de transcription de la parole (STT) performant de 600M de paramètres, optimisé par l'architecture FastConformer-TDT pour une reconnaissance vocale rapide et précise.
Qwen3 Asr 0.6B
Modèle léger de reconnaissance vocale (STT) de 0,6 milliard de paramètres, offrant des transcriptions audio rapides et économiques via la plateforme OpenRouter.
Qwen3 Asr 1.7B
Modèle d'Asie spécialisé dans la transcription audio (STT) de 1,7 milliard de paramètres, accessible de manière flexible via OpenRouter.
Transcribe 1
Un modèle de transcription (STT) multilingue spécialisé dans la détection d'émotions et le multi-locuteur.
Transcribe 1 Pro
Modèle de reconnaissance vocale (speech-to-text) adapté aux réunions et entrevues, intégrant l'identification des locuteurs, la capture des émotions vocales et l'horodatage au mot.
Whisper 1
Modèle de reconnaissance vocale de premier plan développé par OpenAI, conçu pour la transcription automatique de haute précision et le traitement des fichiers audio.
Whisper Large V3
Whisper Large v3 d'OpenAI sur OpenRouter : un modèle ASR de pointe offrant une transcription multilingue ultra-précise à un tarif hautement compétitif.
Whisper Large V3 Turbo
Version optimisée et accélérée du modèle de transcription de référence d'OpenAI, offrant un excellent rapport vitesse-précision pour le traitement audio multilingue.
Aucun modèle ne correspond à cette recherche.