Fil éditorial
Nouveautés
Les nouveaux modèles et les nouvelles versions recensés par la veille, du plus récent au plus ancien.
Septembre 2026
- Texte
Jaredpalmer Jared Palmer Kev-4B
Kev-4B de Jared Palmer est un modèle de décision pure basé sur Qwen3.5-4B, calculant des distributions de probabilités directes sans génération de texte libre.
Outils - Reconnaissance vocale
Google Gemini 3.5 Transcribe
Google lance Gemini 3.5 Transcribe, un modèle vocal dédié surpassant Chirp 3 par sa précision, ses modes intelligents et sa rapidité.
Reconnaissance vocale - Reconnaissance vocale
Fish Audio Transcribe 1 Pro
Fish Audio enrichit son offre ASR avec Transcribe 1 Pro, un moteur audio-texte discret axé sur la transcription fine et l'horodatage.
FichiersReconnaissance vocaleAudio - Synthèse vocale
Google Gemini 3.8 Flash Lite TTS
Google lance Gemini 3.8 Flash-Lite TTS, un modèle texte-vers-audio rapide et économique couvrant 101 langues pour les déploiements à grande échelle.
Synthèse vocale - Texte
Fireworks Fireworks Ember-1
Dérivé de Kimi K3, Fireworks Ember-1 réduit jusqu'à 40 % les jetons de raisonnement pour optimiser les coûts des agents logiciels.
VisionOutilsRaisonnement - Texte
Qwen Qwen 3.8 Max Prime
Déclinaison haute vitesse de Qwen3.8-Max, la variante Prime double le débit de génération pour servir les flux agentiques et interactifs exigeants.
VisionFichiersOutilsRecherche webRaisonnement - Image
Recraft Recraft 4.1 Flash
Recraft V4.1 Flash optimise la génération texte-vers-image raster en misant sur une latence réduite à 1,3 seconde et un coût maîtrisé.
Génération d'images - Texte
Space Bunny Alpha
Modèle anonyme multimodal doté d’un contexte d’un million de tokens, Space Bunny Alpha fait une entrée remarquée et gratuite sur OpenRouter.
VisionOutilsRaisonnement - Texte
Aion Labs Aion-3.5-Mini et Aion-3.0-Mini
Clarification technique sur aion-3.5-mini et analyse détaillée d'Aion-3.0-Mini, le système narratif multi-modèle d'Aion Labs basé sur DeepSeek.
OutilsRaisonnement - Texte
Aion Labs Aion 3.5
Aion Labs lance Aion 3.5, un modèle textuel multi-agents doté d'une fenêtre de contexte de 256K tokens et taillé pour la narration complexe.
OutilsRaisonnement - Texte
Upstage Solar Mini 4
Solar Mini 4 propose une architecture MoE de 35B paramètres et un contexte de 512K tokens optimisé pour les agents légers et le multilingue.
OutilsRaisonnement - Texte
Qwen Qwen 3.8 Omni Flash
Doté d'un contexte d'un million de tokens, Qwen3.8-Omni-Flash traite texte, audio et vidéo pour produire des synthèses textuelles et du raisonnement outillé.
VisionFichiersOutilsRaisonnementAudio - Image
InclusionAI d'InclusionAI Ming Image 0.1 Design
Analyse technique de Ming Image 0.1 Design d'InclusionAI : capacités texte-vers-image, positionnement et limites d'un modèle encore peu documenté.
Génération d'images - Texte
OpenAI GPT-6 Sol
Analyse de la référence gpt-6-sol d'OpenAI : origines des signalements, tarification API communiquée, incertitudes techniques et recommandations d'intégration.
Outils - Texte
OpenAI gpt-6-luna
Analyse de la référence gpt-6-luna chez OpenAI : distinction technique face à GPT-6 Astra et GPT-5.6 Luna, état des spécifications et recommandations.
Outils - Synthèse vocale
Google Gemini 3.8 Flash TTS
Analyse de la référence gemini-3.8-flash-tts, un identifiant non répertorié à distinguer de Gemini 3.8 Flash, Live et 3.1 Flash TTS.
Synthèse vocale - Synthèse vocale
Google Gemini 3.8 Flash Lite TTS
Analyse de la référence gemini-3.8-flash-lite-tts : démêlage des confusions de catalogue et examen de l'état de l'art vocal de Google Gemini.
Synthèse vocale - Texte
Anthropic Claude Opus 5.5
Anthropic dévoile Claude Opus 5.5, taillé pour le code agentique au long cours avec un contexte d'un million de jetons et un raisonnement adaptatif permanent.
VisionOutilsRaisonnement - Texte
DeepSeek DeepSeek V4.1 Flash Batch
Analyse de DeepSeek V4.1 Flash (batch) : architecture MoE de 552 Md de paramètres, contexte de 1M de tokens et optimisation poussée pour les agents logiciels.
VisionFichiersOutilsRaisonnement - Reconnaissance vocale
AssemblyAI AssemblyAI Universal-3.5 Pro
Découvrez AssemblyAI Universal-3.5 Pro : un modèle ASR haute précision axé sur le code-switching, le guidage contextuel et la diarisation avancée.
OutilsReconnaissance vocaleAudio - Texte
Z.ai GLM 5.3 Flashx
Variante rapide de GLM-5.3-Flash, FlashX allie fenêtre de contexte de 1M de jetons, multimodalité native et débit optimisé pour les architectures agentiques.
VisionFichiersOutils - Texte
Xiaomi Mimo V2.6 Pro Ultraspeed
MiMo-V2.6-Pro-UltraSpeed combine un modèle MoE de 1,02 T paramètres, une fenêtre de 1 million de tokens et un débit accéléré pour les agents exigeants.
VisionOutilsRecherche webRaisonnementAudio - Texte
Xiaomi Mimo V2.6 Pro
Xiaomi dévoile MiMo-V2.6-Pro, un modèle MoE de 1,02 T de paramètres doté d'une fenêtre de contexte de 1 M de tokens et taillé pour les flux agentiques complexes.
VisionOutilsRecherche webRaisonnementAudio - Texte
Xiaomi Mimo V2.6 Flash
Xiaomi dévoile MiMo-V2.6-Flash, un modèle MoE open source de 309 milliards de paramètres doté d'une fenêtre de contexte de 1 million de tokens.
VisionOutilsRecherche webRaisonnementAudio - Texte
Unbiased Unbiased Pareto
Découvrez Unbiased Pareto, un modèle composite alliant vision, vaste contexte et synthèse de plusieurs LLM pour les flux de recherche et de code.
VisionOutils - Texte
Typesafe Jev 1.13
Jev 1.13 abandonne la génération de prose pour transformer du texte en décisions typées ultra-rapides et économiques.
Outils - Texte
Qwen Qwen 3.8 27B
Disponible sans frais sur OpenRouter, Qwen3.8 27B associe analyse visuelle native, raisonnement modulable et 262k tokens de contexte.
VisionFichiersOutilsRaisonnement - Texte
Prism ML Ternary Bonsai 2 27B
Bonsai 2 27B compresse Qwen3.8-27B en poids ternaires pour offrir 262k tokens de contexte et un raisonnement avancé sur GPU unique.
VisionFichiersOutilsRaisonnement - Texte
Nex AGI Nex N2.5 Pro
Découvrez Nex-N2.5-Pro de Nex AGI : architecture MoE de 397B, vision pour boucles agentiques et fenêtre contextuelle de 262k tokens.
VisionOutilsRaisonnement - Texte
Prism ML Ternary Bonsai 2 27B
Dérivé de Qwen3.8-27B, Ternary Bonsai 2 27B compresse un modèle multimodal de 27B à ~1,72 bit par poids, réduisant son empreinte à moins de 8 Go.
VisionFichiersOutilsRaisonnement - Texte
Nex AGI Nex N2.5 Pro
Nex-N2.5-Pro combine 397 milliards de paramètres et vision avancée pour l'automatisation logicielle et l'interaction avec des interfaces graphiques.
VisionOutilsRaisonnement - Texte
Nex AGI Nex N2.5 Mini
Nex-N2.5-Mini propose 35 milliards de paramètres et 262K de contexte pour les flux agentiques et l'automatisation visuelle à coût maîtrisé.
VisionFichiersOutilsRaisonnement - Texte
xAI Grok 4.7
xAI dévoile Grok 4.7, un modèle orienté code et raisonnement doté d'une fenêtre de 500 000 tokens et entraîné sur des flux agentiques.
VisionOutilsRecherche webRaisonnement - Texte
xAI Grok 4.7
xAI présente Grok 4.7, un modèle orienté ingénierie logicielle et raisonnement approfondi, doté d'une fenêtre de contexte de 500 000 tokens.
VisionOutilsRecherche webRaisonnement - Texte
Union Alpha
Apparu discrètement sur OpenRouter, Union Alpha promet des performances de pointe et une fenêtre de 262K tokens, sous couvert d'anonymat.
VisionOutils - Audio
Google Gemini 3.8 Live Extended Thinking
Google déploie Gemini 3.8 Live Extended Thinking, un modèle audio-à-audio capable de raisonner et d'exécuter des outils en tâche de fond tout en parlant.
Audio - Audio
Google Gemini 3.8 Live
Conçu pour les dialogues audio à faible latence, Gemini 3.8 Live allie vision en temps réel, appels d'outils asynchrones et interaction vocale fluide.
Audio - Texte
Mistral Z.ai GLM 5.3 sur
Intégré par Mistral, GLM-5.3 de Z.ai offre 1 million de jetons de contexte et 753 milliards de paramètres pour le code et les agents autonomes.
OutilsRaisonnement - Texte
Mistral GLM-5
Découvrez GLM-5 de Z.ai hébergé par Mistral : une architecture MoE de 744B paramètres dédiée à l'ingénierie logicielle et aux agents autonomes.
OutilsRaisonnement - Texte
Mistral Z.ai GLM 5.3 sur
Hébergé sans modification par Mistral, zai-glm-5-3 offre 1M de tokens de contexte et une architecture MoE de pointe pour l'ingénierie logicielle complexe.
OutilsRaisonnement - Texte
Mistral GLM-5
Intégré à l'infrastructure Mistral, le modèle Z.ai GLM 5.3 offre un contexte d'un million de tokens et des capacités avancées pour les agents logiciels.
OutilsRaisonnement - Texte
Mistral GLM-5
Analyse de GLM-5 de Z.ai : architecture MoE 744B, capacités en ingénierie agentique, performances et statut de l'identifiant zai-glm-5 chez Mistral.
OutilsRaisonnement - Texte
Mistral Z.ai GLM 5.3 sur
Z.ai GLM 5.3 rejoint l'API Mistral en préversion publique : un modèle MoE de 753 milliards de paramètres taillé pour le code complexe et les agents.
OutilsRaisonnement - Texte
Mistral GLM-5
Découvrez GLM-5 de Z.ai, un modèle MoE orienté ingénierie logicielle et agents autonomes, hébergé sans altération sur l'infrastructure de Mistral.
OutilsRaisonnement - Texte
Mistral Z.ai GLM 5.3 sur
Hébergé sans modification par Mistral, le modèle GLM 5.3 de Z.ai propose 1 million de tokens de contexte et une spécialisation poussée en ingénierie logicielle.
OutilsRaisonnement - Texte
Mistral GLM-5
Intégré par Mistral en préversion publique, Z.ai GLM 5.3 offre un contexte de 1M de tokens et des capacités avancées pour l'ingénierie logicielle.
OutilsRaisonnement - Texte
Mistral GLM-5
Découvrez les capacités de GLM-5, modèle textuel ouvert de 744 milliards de paramètres conçu pour le raisonnement long et le développement logiciel.
OutilsRaisonnement - Texte
Z.ai Z.ai GLM-5.3 (batch)
Découvrez GLM-5.3 (batch) de Z.ai : modèle de raisonnement pour le code, fenêtre de 1M de tokens et capacités pour agents autonomes.
FichiersOutilsRaisonnement - Texte
Sakana Sakana Fugu Max
Découvrez Fugu Max de Sakana AI : un orchestrateur multi-modèles doté d'un contexte de 1M de tokens, taillé pour optimiser le rapport performance-coût.
VisionFichiersOutilsRecherche webRaisonnement - Texte
Z.ai Z.ai GLM-5.3 (batch)
Doté de 753 milliards de paramètres et d'un contexte d'un million de tokens, GLM-5.3 de Z.ai cible les flux d'ingénierie logicielle et les agents autonomes.
FichiersOutilsRaisonnement - Texte
Sakana Sakana Fugu Max
Fugu Max associe orchestration multi-agents, contexte d'un million de tokens et tarification agressive pour optimiser les flux de travail complexes.
VisionFichiersOutilsRecherche webRaisonnement - Texte
Z.ai Z.ai GLM-5.3 (batch)
Tour d'horizon de GLM-5.3 (batch) de Z.ai : un modèle de 753 milliards de paramètres optimisé pour les agents, le code et l'analyse de contextes longs.
FichiersOutilsRaisonnement - Texte
Sakana Sakana Fugu Max
Sakana AI lance Fugu Max, un orchestrateur multi-agents multimodal doté d'un contexte de 1M de tokens, alliant performances de pointe et maîtrise des coûts.
VisionFichiersOutilsRecherche webRaisonnement - Texte
Nex AGI Nex-N2.5-Pro
Découvrez Nex-N2.5-Pro de Nex-AGI sur OpenRouter : un modèle agentique ouvert conçu pour l'ingénierie logicielle et le pilotage d'interfaces graphiques.
VisionOutilsRaisonnement - Texte
Nex AGI Nex-N2.5-Mini
Nex-N2.5-Mini apporte des capacités agentiques et de vision avancées dans un format MoE de 35 milliards de paramètres disponible gratuitement sur OpenRouter.
VisionOutilsRaisonnement - Reconnaissance vocale
Meta Muse Voice Transcribe 1.0
Meta lance Muse Voice Transcribe 1.0, un modèle de reconnaissance vocale et de diarisation temps réel combinant streaming adaptatif et haute précision.
FichiersReconnaissance vocaleAudio - Texte
Inference Net InferenceNet Schematron V2 Turbo
Découvrez Schematron V2 Turbo, un modèle 3B spécialisé dans l'extraction de données HTML vers JSON, alliant haut débit et décodage contraint par schéma.
Outils - Texte
Inference Net InferenceNet Schematron V2 Small
Découvrez Schematron V2 Small, un modèle compact de 3B paramètres optimisé pour transformer le code HTML en données JSON parfaitement typées.
Outils - Texte
InclusionAI Ling-3.0-Flash-VL sur
InclusionAI déploie Ling-3.0-flash-VL, un modèle MoE multimodal de 124 milliards de paramètres associant texte, vision et un contexte de 262 144 tokens.
VisionFichiersOutilsRaisonnement - Texte
InclusionAI Ling-3.0-Flash-VL sur
Ling 3.0 Flash VL combine architecture MoE, raisonnement multimodal et fenêtre de 262 144 tokens, disponible gratuitement via OpenRouter.
VisionFichiersOutilsRaisonnement - Texte
Inference Net InferenceNet Schematron V2 Small
Découvrez Schematron V2 Small, un modèle 3B spécialisé d'Inference.net dédié au parsing HTML vers JSON contraint par schéma, disponible via OpenRouter.
Outils - Texte
InclusionAI Ling-3.0-Flash-VL sur
Ling-3.0-flash-VL associe une architecture MoE de 124B paramètres à une fenêtre de 262K tokens pour l'analyse conjointe de texte, d'images et de vidéo.
VisionFichiersOutilsRaisonnement - Texte
Inference Net InferenceNet Schematron V2 Small
Découvrez Schematron V2 Small, modèle 3B d'InferenceNet dédié à l'extraction HTML vers JSON contrainte par schéma, économique et optimisé pour le scraping.
Outils - Texte
InclusionAI Ling-3.0-Flash-VL sur
Découvrez Ling-3.0-Flash-VL d'inclusionAI : un modèle MoE vision-langage de 124B paramètres disponible gratuitement sur OpenRouter.
VisionFichiersOutilsRaisonnement - Texte
InclusionAI Ling-3.0-flash-VL
Découvrez Ling-3.0-flash-VL, modèle MoE multimodal d'InclusionAI sous licence MIT, alliant vision, vidéo et raisonnement à coût réduit.
VisionFichiersOutilsRaisonnement - Texte
Inception Inception Mercury 2.5
Inception dévoile Mercury 2.5, un modèle de langage par diffusion (dLLM) alliant 260 000 tokens de contexte et une cadence de génération très élevée.
OutilsRaisonnement - Texte
DeepSeek DeepSeek V4.1 Flash
Découvrez DeepSeek-V4.1-Flash : architecture MoE asymétrique, contexte de 1 million de tokens et performances avancées pour le code et les agents.
VisionOutilsRaisonnement - Texte
DeepSeek DeepSeek V4.1 Flash
DeepSeek dévoile V4.1 Flash, un modèle MoE asymétrique de 552B paramètres optimisé pour les agents, le code et l'analyse visuelle jusqu'à 1M de tokens.
VisionOutilsRaisonnement - Texte
Inception Inception Mercury 2.5
Inception dévoile Mercury 2.5, un modèle de langage par diffusion conçu pour les agents textuels et l'inférence à haut débit.
OutilsRaisonnement - Texte
DeepSeek DeepSeek V4.1 Flash
DeepSeek dévoile V4.1 Flash, un modèle MoE multimodal de 552 Md de paramètres doté d'une fenêtre d'un million de tokens pour les flux agentiques.
VisionOutilsRaisonnement - Texte
Inception Inception Mercury 2.5
Découvrez Mercury 2.5 d'Inception, un modèle de langage par diffusion taillé pour les flux agentiques rapides et économiques.
OutilsRaisonnement - Texte
DeepSeek DeepSeek V4.1 Flash
Découvrez DeepSeek V4.1 Flash, un modèle MoE de 552 milliards de paramètres doté d'une fenêtre de contexte de 1 million de tokens.
VisionOutilsRaisonnement - Texte
DeepSeek DeepSeek V4 Flash Vision Exp (Batch) sur
Analyse technique de DeepSeek V4 Flash Vision Exp (Batch) sur OpenRouter : capacités visuelles, benchmarks, tarification et cycle de vie.
VisionFichiersOutils - Vidéo
Black Forest Labs FLUX Video Edit
Black Forest Labs lance FLUX Video Edit, un outil spécialisé dans la retouche vidéo précise par instruction textuelle, désormais répertorié sur OpenRouter.
VisionFichiersGénération vidéoAudio - Texte
Google Antigravity-Preview-09-2026
Analyse de l'identifiant antigravity-preview-09-2026 de Google : origines de la fuite, architecture agentique probable, limites et statut de déploiement.
Outils - Texte
OpenAI GPT-Live-1
Découvrez GPT-Live-1, le modèle vocal temps réel d'OpenAI doté d'une architecture full duplex et d'un système de délégation backend.
OutilsSynthèse vocaleReconnaissance vocaleAudio - Image
OpenAI GPT Image 2.5 Sunburst
Analyse technique de GPT-Image-2.5 Sunburst d'OpenAI, le modèle dédié à la génération visuelle haute fidélité et à la retouche multi-images exigeante.
VisionGénération d'images - Image
OpenAI GPT-Image 2.5 Flare
OpenAI dévoile GPT-Image-2.5 Flare, un modèle d'imagerie rapide réduisant la latence de 50 %, désormais activé et disponible sur notre plateforme.
VisionGénération d'images - Texte
Qwen Qwen 3.8 Max (0902)
Découvrez le snapshot Qwen3.8-Max-0902, un modèle MoE de 2 400 milliards de paramètres conçu pour le développement logiciel complexe et les agents autonomes.
VisionFichiersOutilsRaisonnement - Image
Microsoft Mai Image 2.6 Flash
Découvrez le modèle MAI-Image-2.6-Flash de Microsoft, conçu pour la génération d'images ultra-rapide et à grand volume en production.
VisionFichiersGénération d'images