Observatoire Québec

Modèles d'intelligence artificielle

La dernière version de chaque famille de modèles recensée, avec ses capacités, son fournisseur et son historique complet.

Familles de modèles
567
Versions recensées
805
Fournisseurs
87
Mise à jour
25 septembre 2026

20 modèles affichés, classés de la sortie la plus récente à la plus ancienne

CohereReconnaissance vocale

Cohere Transcribe 03 2026

Dernière versionTranscribe 03-2026mars 2026

Modèle de transcription de la parole en texte (STT) de Cohere, adapté aux exigences de traitement souverain et sécurisé des données au Québec.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
QwenReconnaissance vocale

Qwen3 Asr Flash

Dernière versionQwen3-ASR-Flash (2026-02-10)février 2026

Le modèle de reconnaissance vocale qwen3-asr-flash-2026-02-10 d'Alibaba : capacités, performances, tarifs et intégration via OpenRouter.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
DeepgramReconnaissance vocale

Nova 3

Dernière versionNova-3 Multilingualmars 2025

Modèle de transcription vocale (STT) de pointe, offrant une rapidité d'exécution et une précision accrue pour les flux audio complexes.

Reconnaissance vocaleAudio
2 versions recenséesVoir la fiche
GoogleReconnaissance vocale

Chirp 3

Dernière versiongoogle/chirp-3

Google Chirp 3, le modèle ASR de pointe de Google Cloud, désormais disponible pour la transcription audio-vers-texte sur OpenRouter.

OutilsReconnaissance vocaleAudio
1 version recenséeVoir la fiche
GoogleReconnaissance vocale

Gemini Transcribe

Dernière versionGemini 3.5 Transcribe Live

L’identifiant gemini-3.5-transcribe et étude de Gemini 3.5 Flash, le modèle multimodal de référence de Google pour la transcription avancée.

Reconnaissance vocaleAudio
2 versions recenséesVoir la fiche
OpenAIReconnaissance vocale

GPT Live Transcribe

Dernière versiongpt-live-transcribe

Décryptage de l'identifiant gpt-live-transcribe, à la croisée des technologies GPT-Realtime-Whisper et GPT-Live d'OpenAI.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
OpenAIReconnaissance vocale

GPT Realtime Whisper

Dernière versionWhisper Realtime

Modèle de transcription audio en temps réel (Speech-to-Text) par OpenAI, conçu pour convertir instantanément des flux de parole en texte écrit.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
OpenAIReconnaissance vocale

GPT Transcribe

Dernière versiongpt-transcribe

Le modèle spécialisé d'OpenAI conçu pour la transcription précise de fichiers audio finalisés et de sessions Realtime.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
MicrosoftReconnaissance vocale

Mai Transcribe 1.5

Dernière versionmicrosoft/mai-transcribe-1.5

Modèle de transcription audio (Speech-to-Text) développé par Microsoft, conçu pour convertir la parole en texte de manière performante et économique via OpenRouter.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
MicrosoftReconnaissance vocale

Mai Transcribe 2

Dernière versionmicrosoft/mai-transcribe-2

Modèle de reconnaissance vocale de Microsoft, proposé via OpenRouter pour la transcription efficace de contenus audio en texte à un coût d'entrée très compétitif.

FichiersReconnaissance vocaleAudio
1 version recenséeVoir la fiche
MetaReconnaissance vocale

Muse Voice Transcribe 1.0

Dernière versionmeta/muse-voice-transcribe-1.0

Meta lance Muse Voice Transcribe 1.0, un modèle de reconnaissance vocale et de diarisation temps réel combinant streaming adaptatif et haute précision.

FichiersReconnaissance vocaleAudio
1 version recenséeVoir la fiche
NVIDIAReconnaissance vocale

Nemotron 3.5 Asr Streaming Multilingual 0.6B

Dernière versionNemotron-3.5 ASR Streaming 0.6B

Modèle d'ASR multilingue ultra-léger conçu par NVIDIA pour la transcription audio en temps réel et à faible latence via OpenRouter.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
NVIDIAReconnaissance vocale

Parakeet Tdt 0.6B V3

Dernière versionnvidia/parakeet-tdt-0.6b-v3

Modèle de transcription de la parole (STT) performant de 600M de paramètres, optimisé par l'architecture FastConformer-TDT pour une reconnaissance vocale rapide et précise.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
QwenReconnaissance vocale

Qwen3 Asr 0.6B

Dernière versionQwen 3 ASR 0.6B

Modèle léger de reconnaissance vocale (STT) de 0,6 milliard de paramètres, offrant des transcriptions audio rapides et économiques via la plateforme OpenRouter.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
QwenReconnaissance vocale

Qwen3 Asr 1.7B

Dernière versionqwen/qwen3-asr-1.7b

Modèle d'Asie spécialisé dans la transcription audio (STT) de 1,7 milliard de paramètres, accessible de manière flexible via OpenRouter.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
Fish AudioReconnaissance vocale

Transcribe 1

Dernière versionFish Audio Transcribe 1

Un modèle de transcription (STT) multilingue spécialisé dans la détection d'émotions et le multi-locuteur.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
Fish AudioReconnaissance vocale

Transcribe 1 Pro

Dernière versionfish-audio/transcribe-1-pro

Modèle de reconnaissance vocale (speech-to-text) adapté aux réunions et entrevues, intégrant l'identification des locuteurs, la capture des émotions vocales et l'horodatage au mot.

FichiersReconnaissance vocaleAudio
1 version recenséeVoir la fiche
OpenAIReconnaissance vocale

Whisper 1

Dernière versionWhisper-1

Modèle de reconnaissance vocale de premier plan développé par OpenAI, conçu pour la transcription automatique de haute précision et le traitement des fichiers audio.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
OpenAIReconnaissance vocale

Whisper Large V3

Dernière versiond'OpenAI Whisper Large v3 sur

Whisper Large v3 d'OpenAI sur OpenRouter : un modèle ASR de pointe offrant une transcription multilingue ultra-précise à un tarif hautement compétitif.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche
OpenAIReconnaissance vocale

Whisper Large V3 Turbo

Dernière versionopenai/whisper-large-v3-turbo

Version optimisée et accélérée du modèle de transcription de référence d'OpenAI, offrant un excellent rapport vitesse-précision pour le traitement audio multilingue.

Reconnaissance vocaleAudio
1 version recenséeVoir la fiche

Liste de modèles fournie par la plateforme ProductivIA

productivia.ca