Fil éditorial

Nouveautés

Les nouveaux modèles et les nouvelles versions recensés par la veille, du plus récent au plus ancien.

S'abonner au flux RSS

Septembre 2026

  1. Texte

    Nouveau modèle

    Jaredpalmer Jared Palmer Kev-4B

    Kev-4B de Jared Palmer est un modèle de décision pure basé sur Qwen3.5-4B, calculant des distributions de probabilités directes sans génération de texte libre.

    Outils
  2. Reconnaissance vocale

    Nouveau modèle

    Google Gemini 3.5 Transcribe

    Google lance Gemini 3.5 Transcribe, un modèle vocal dédié surpassant Chirp 3 par sa précision, ses modes intelligents et sa rapidité.

    Reconnaissance vocale
  3. Reconnaissance vocale

    Nouveau modèle

    Fish Audio Transcribe 1 Pro

    Fish Audio enrichit son offre ASR avec Transcribe 1 Pro, un moteur audio-texte discret axé sur la transcription fine et l'horodatage.

    FichiersReconnaissance vocaleAudio
  4. Synthèse vocale

    Nouveau modèle

    Google Gemini 3.8 Flash Lite TTS

    Google lance Gemini 3.8 Flash-Lite TTS, un modèle texte-vers-audio rapide et économique couvrant 101 langues pour les déploiements à grande échelle.

    Synthèse vocale
  5. Texte

    Nouveau modèle

    Fireworks Fireworks Ember-1

    Dérivé de Kimi K3, Fireworks Ember-1 réduit jusqu'à 40 % les jetons de raisonnement pour optimiser les coûts des agents logiciels.

    VisionOutilsRaisonnement
  6. Texte

    Nouveau modèle

    Qwen Qwen 3.8 Max Prime

    Déclinaison haute vitesse de Qwen3.8-Max, la variante Prime double le débit de génération pour servir les flux agentiques et interactifs exigeants.

    VisionFichiersOutilsRecherche webRaisonnement
  7. Image

    Nouveau modèle

    Recraft Recraft 4.1 Flash

    Recraft V4.1 Flash optimise la génération texte-vers-image raster en misant sur une latence réduite à 1,3 seconde et un coût maîtrisé.

    Génération d'images
  8. Texte

    Nouveau modèle

    Space Bunny Alpha

    Modèle anonyme multimodal doté d’un contexte d’un million de tokens, Space Bunny Alpha fait une entrée remarquée et gratuite sur OpenRouter.

    VisionOutilsRaisonnement
  9. Texte

    Nouveau modèle

    Aion Labs Aion-3.5-Mini et Aion-3.0-Mini

    Clarification technique sur aion-3.5-mini et analyse détaillée d'Aion-3.0-Mini, le système narratif multi-modèle d'Aion Labs basé sur DeepSeek.

    OutilsRaisonnement
  10. Texte

    Nouveau modèle

    Aion Labs Aion 3.5

    Aion Labs lance Aion 3.5, un modèle textuel multi-agents doté d'une fenêtre de contexte de 256K tokens et taillé pour la narration complexe.

    OutilsRaisonnement
  11. Texte

    Nouveau modèle

    Upstage Solar Mini 4

    Solar Mini 4 propose une architecture MoE de 35B paramètres et un contexte de 512K tokens optimisé pour les agents légers et le multilingue.

    OutilsRaisonnement
  12. Texte

    Nouveau modèle

    Qwen Qwen 3.8 Omni Flash

    Doté d'un contexte d'un million de tokens, Qwen3.8-Omni-Flash traite texte, audio et vidéo pour produire des synthèses textuelles et du raisonnement outillé.

    VisionFichiersOutilsRaisonnementAudio
  13. Image

    Nouveau modèle

    InclusionAI d'InclusionAI Ming Image 0.1 Design

    Analyse technique de Ming Image 0.1 Design d'InclusionAI : capacités texte-vers-image, positionnement et limites d'un modèle encore peu documenté.

    Génération d'images
  14. Texte

    Nouveau modèle

    OpenAI GPT-6 Sol

    Analyse de la référence gpt-6-sol d'OpenAI : origines des signalements, tarification API communiquée, incertitudes techniques et recommandations d'intégration.

    Outils
  15. Texte

    Nouveau modèle

    OpenAI gpt-6-luna

    Analyse de la référence gpt-6-luna chez OpenAI : distinction technique face à GPT-6 Astra et GPT-5.6 Luna, état des spécifications et recommandations.

    Outils
  16. Synthèse vocale

    Nouveau modèle

    Google Gemini 3.8 Flash TTS

    Analyse de la référence gemini-3.8-flash-tts, un identifiant non répertorié à distinguer de Gemini 3.8 Flash, Live et 3.1 Flash TTS.

    Synthèse vocale
  17. Synthèse vocale

    Nouveau modèle

    Google Gemini 3.8 Flash Lite TTS

    Analyse de la référence gemini-3.8-flash-lite-tts : démêlage des confusions de catalogue et examen de l'état de l'art vocal de Google Gemini.

    Synthèse vocale
  18. Texte

    Nouveau modèle

    Anthropic Claude Opus 5.5

    Anthropic dévoile Claude Opus 5.5, taillé pour le code agentique au long cours avec un contexte d'un million de jetons et un raisonnement adaptatif permanent.

    VisionOutilsRaisonnement
  19. Texte

    Nouveau modèle

    DeepSeek DeepSeek V4.1 Flash Batch

    Analyse de DeepSeek V4.1 Flash (batch) : architecture MoE de 552 Md de paramètres, contexte de 1M de tokens et optimisation poussée pour les agents logiciels.

    VisionFichiersOutilsRaisonnement
  20. Reconnaissance vocale

    Nouveau modèle

    AssemblyAI AssemblyAI Universal-3.5 Pro

    Découvrez AssemblyAI Universal-3.5 Pro : un modèle ASR haute précision axé sur le code-switching, le guidage contextuel et la diarisation avancée.

    OutilsReconnaissance vocaleAudio
  21. Texte

    Nouveau modèle

    Z.ai GLM 5.3 Flashx

    Variante rapide de GLM-5.3-Flash, FlashX allie fenêtre de contexte de 1M de jetons, multimodalité native et débit optimisé pour les architectures agentiques.

    VisionFichiersOutils
  22. Texte

    Nouveau modèle

    Xiaomi Mimo V2.6 Pro Ultraspeed

    MiMo-V2.6-Pro-UltraSpeed combine un modèle MoE de 1,02 T paramètres, une fenêtre de 1 million de tokens et un débit accéléré pour les agents exigeants.

    VisionOutilsRecherche webRaisonnementAudio
  23. Texte

    Nouveau modèle

    Xiaomi Mimo V2.6 Pro

    Xiaomi dévoile MiMo-V2.6-Pro, un modèle MoE de 1,02 T de paramètres doté d'une fenêtre de contexte de 1 M de tokens et taillé pour les flux agentiques complexes.

    VisionOutilsRecherche webRaisonnementAudio
  24. Texte

    Nouveau modèle

    Xiaomi Mimo V2.6 Flash

    Xiaomi dévoile MiMo-V2.6-Flash, un modèle MoE open source de 309 milliards de paramètres doté d'une fenêtre de contexte de 1 million de tokens.

    VisionOutilsRecherche webRaisonnementAudio
  25. Texte

    Nouveau modèle

    Unbiased Unbiased Pareto

    Découvrez Unbiased Pareto, un modèle composite alliant vision, vaste contexte et synthèse de plusieurs LLM pour les flux de recherche et de code.

    VisionOutils
  26. Texte

    Nouveau modèle

    Typesafe Jev 1.13

    Jev 1.13 abandonne la génération de prose pour transformer du texte en décisions typées ultra-rapides et économiques.

    Outils
  27. Texte

    Nouveau modèle

    Qwen Qwen 3.8 27B

    Disponible sans frais sur OpenRouter, Qwen3.8 27B associe analyse visuelle native, raisonnement modulable et 262k tokens de contexte.

    VisionFichiersOutilsRaisonnement
  28. Texte

    Nouveau modèle

    Prism ML Ternary Bonsai 2 27B

    Bonsai 2 27B compresse Qwen3.8-27B en poids ternaires pour offrir 262k tokens de contexte et un raisonnement avancé sur GPU unique.

    VisionFichiersOutilsRaisonnement
  29. Texte

    Nouveau modèle

    Nex AGI Nex N2.5 Pro

    Découvrez Nex-N2.5-Pro de Nex AGI : architecture MoE de 397B, vision pour boucles agentiques et fenêtre contextuelle de 262k tokens.

    VisionOutilsRaisonnement
  30. Texte

    Nouveau modèle

    Prism ML Ternary Bonsai 2 27B

    Dérivé de Qwen3.8-27B, Ternary Bonsai 2 27B compresse un modèle multimodal de 27B à ~1,72 bit par poids, réduisant son empreinte à moins de 8 Go.

    VisionFichiersOutilsRaisonnement
  31. Texte

    Nouveau modèle

    Nex AGI Nex N2.5 Pro

    Nex-N2.5-Pro combine 397 milliards de paramètres et vision avancée pour l'automatisation logicielle et l'interaction avec des interfaces graphiques.

    VisionOutilsRaisonnement
  32. Texte

    Nouveau modèle

    Nex AGI Nex N2.5 Mini

    Nex-N2.5-Mini propose 35 milliards de paramètres et 262K de contexte pour les flux agentiques et l'automatisation visuelle à coût maîtrisé.

    VisionFichiersOutilsRaisonnement
  33. Texte

    Nouveau modèle

    xAI Grok 4.7

    xAI dévoile Grok 4.7, un modèle orienté code et raisonnement doté d'une fenêtre de 500 000 tokens et entraîné sur des flux agentiques.

    VisionOutilsRecherche webRaisonnement
  34. Texte

    Nouveau modèle

    xAI Grok 4.7

    xAI présente Grok 4.7, un modèle orienté ingénierie logicielle et raisonnement approfondi, doté d'une fenêtre de contexte de 500 000 tokens.

    VisionOutilsRecherche webRaisonnement
  35. Texte

    Nouveau modèle

    Union Alpha

    Apparu discrètement sur OpenRouter, Union Alpha promet des performances de pointe et une fenêtre de 262K tokens, sous couvert d'anonymat.

    VisionOutils
  36. Audio

    Nouveau modèle

    Google Gemini 3.8 Live Extended Thinking

    Google déploie Gemini 3.8 Live Extended Thinking, un modèle audio-à-audio capable de raisonner et d'exécuter des outils en tâche de fond tout en parlant.

    Audio
  37. Audio

    Nouveau modèle

    Google Gemini 3.8 Live

    Conçu pour les dialogues audio à faible latence, Gemini 3.8 Live allie vision en temps réel, appels d'outils asynchrones et interaction vocale fluide.

    Audio
  38. Texte

    Nouveau modèle

    Mistral Z.ai GLM 5.3 sur

    Intégré par Mistral, GLM-5.3 de Z.ai offre 1 million de jetons de contexte et 753 milliards de paramètres pour le code et les agents autonomes.

    OutilsRaisonnement
  39. Texte

    Nouveau modèle

    Mistral GLM-5

    Découvrez GLM-5 de Z.ai hébergé par Mistral : une architecture MoE de 744B paramètres dédiée à l'ingénierie logicielle et aux agents autonomes.

    OutilsRaisonnement
  40. Texte

    Nouveau modèle

    Mistral Z.ai GLM 5.3 sur

    Hébergé sans modification par Mistral, zai-glm-5-3 offre 1M de tokens de contexte et une architecture MoE de pointe pour l'ingénierie logicielle complexe.

    OutilsRaisonnement
  41. Texte

    Nouveau modèle

    Mistral GLM-5

    Intégré à l'infrastructure Mistral, le modèle Z.ai GLM 5.3 offre un contexte d'un million de tokens et des capacités avancées pour les agents logiciels.

    OutilsRaisonnement
  42. Texte

    Nouveau modèle

    Mistral GLM-5

    Analyse de GLM-5 de Z.ai : architecture MoE 744B, capacités en ingénierie agentique, performances et statut de l'identifiant zai-glm-5 chez Mistral.

    OutilsRaisonnement
  43. Texte

    Nouveau modèle

    Mistral Z.ai GLM 5.3 sur

    Z.ai GLM 5.3 rejoint l'API Mistral en préversion publique : un modèle MoE de 753 milliards de paramètres taillé pour le code complexe et les agents.

    OutilsRaisonnement
  44. Texte

    Nouveau modèle

    Mistral GLM-5

    Découvrez GLM-5 de Z.ai, un modèle MoE orienté ingénierie logicielle et agents autonomes, hébergé sans altération sur l'infrastructure de Mistral.

    OutilsRaisonnement
  45. Texte

    Nouveau modèle

    Mistral Z.ai GLM 5.3 sur

    Hébergé sans modification par Mistral, le modèle GLM 5.3 de Z.ai propose 1 million de tokens de contexte et une spécialisation poussée en ingénierie logicielle.

    OutilsRaisonnement
  46. Texte

    Nouveau modèle

    Mistral GLM-5

    Intégré par Mistral en préversion publique, Z.ai GLM 5.3 offre un contexte de 1M de tokens et des capacités avancées pour l'ingénierie logicielle.

    OutilsRaisonnement
  47. Texte

    Nouveau modèle

    Mistral GLM-5

    Découvrez les capacités de GLM-5, modèle textuel ouvert de 744 milliards de paramètres conçu pour le raisonnement long et le développement logiciel.

    OutilsRaisonnement
  48. Texte

    Nouveau modèle

    Z.ai Z.ai GLM-5.3 (batch)

    Découvrez GLM-5.3 (batch) de Z.ai : modèle de raisonnement pour le code, fenêtre de 1M de tokens et capacités pour agents autonomes.

    FichiersOutilsRaisonnement
  49. Texte

    Nouveau modèle

    Sakana Sakana Fugu Max

    Découvrez Fugu Max de Sakana AI : un orchestrateur multi-modèles doté d'un contexte de 1M de tokens, taillé pour optimiser le rapport performance-coût.

    VisionFichiersOutilsRecherche webRaisonnement
  50. Texte

    Nouveau modèle

    Z.ai Z.ai GLM-5.3 (batch)

    Doté de 753 milliards de paramètres et d'un contexte d'un million de tokens, GLM-5.3 de Z.ai cible les flux d'ingénierie logicielle et les agents autonomes.

    FichiersOutilsRaisonnement
  51. Texte

    Nouveau modèle

    Sakana Sakana Fugu Max

    Fugu Max associe orchestration multi-agents, contexte d'un million de tokens et tarification agressive pour optimiser les flux de travail complexes.

    VisionFichiersOutilsRecherche webRaisonnement
  52. Texte

    Nouveau modèle

    Z.ai Z.ai GLM-5.3 (batch)

    Tour d'horizon de GLM-5.3 (batch) de Z.ai : un modèle de 753 milliards de paramètres optimisé pour les agents, le code et l'analyse de contextes longs.

    FichiersOutilsRaisonnement
  53. Texte

    Nouveau modèle

    Sakana Sakana Fugu Max

    Sakana AI lance Fugu Max, un orchestrateur multi-agents multimodal doté d'un contexte de 1M de tokens, alliant performances de pointe et maîtrise des coûts.

    VisionFichiersOutilsRecherche webRaisonnement
  54. Texte

    Nouveau modèle

    Nex AGI Nex-N2.5-Pro

    Découvrez Nex-N2.5-Pro de Nex-AGI sur OpenRouter : un modèle agentique ouvert conçu pour l'ingénierie logicielle et le pilotage d'interfaces graphiques.

    VisionOutilsRaisonnement
  55. Texte

    Nouveau modèle

    Nex AGI Nex-N2.5-Mini

    Nex-N2.5-Mini apporte des capacités agentiques et de vision avancées dans un format MoE de 35 milliards de paramètres disponible gratuitement sur OpenRouter.

    VisionOutilsRaisonnement
  56. Reconnaissance vocale

    Nouveau modèle

    Meta Muse Voice Transcribe 1.0

    Meta lance Muse Voice Transcribe 1.0, un modèle de reconnaissance vocale et de diarisation temps réel combinant streaming adaptatif et haute précision.

    FichiersReconnaissance vocaleAudio
  57. Texte

    Nouveau modèle

    Inference Net InferenceNet Schematron V2 Turbo

    Découvrez Schematron V2 Turbo, un modèle 3B spécialisé dans l'extraction de données HTML vers JSON, alliant haut débit et décodage contraint par schéma.

    Outils
  58. Texte

    Nouveau modèle

    Inference Net InferenceNet Schematron V2 Small

    Découvrez Schematron V2 Small, un modèle compact de 3B paramètres optimisé pour transformer le code HTML en données JSON parfaitement typées.

    Outils
  59. Texte

    Nouveau modèle

    InclusionAI Ling-3.0-Flash-VL sur

    InclusionAI déploie Ling-3.0-flash-VL, un modèle MoE multimodal de 124 milliards de paramètres associant texte, vision et un contexte de 262 144 tokens.

    VisionFichiersOutilsRaisonnement
  60. Texte

    Nouveau modèle

    InclusionAI Ling-3.0-Flash-VL sur

    Ling 3.0 Flash VL combine architecture MoE, raisonnement multimodal et fenêtre de 262 144 tokens, disponible gratuitement via OpenRouter.

    VisionFichiersOutilsRaisonnement
  61. Texte

    Nouveau modèle

    Inference Net InferenceNet Schematron V2 Small

    Découvrez Schematron V2 Small, un modèle 3B spécialisé d'Inference.net dédié au parsing HTML vers JSON contraint par schéma, disponible via OpenRouter.

    Outils
  62. Texte

    Nouveau modèle

    InclusionAI Ling-3.0-Flash-VL sur

    Ling-3.0-flash-VL associe une architecture MoE de 124B paramètres à une fenêtre de 262K tokens pour l'analyse conjointe de texte, d'images et de vidéo.

    VisionFichiersOutilsRaisonnement
  63. Texte

    Nouveau modèle

    Inference Net InferenceNet Schematron V2 Small

    Découvrez Schematron V2 Small, modèle 3B d'InferenceNet dédié à l'extraction HTML vers JSON contrainte par schéma, économique et optimisé pour le scraping.

    Outils
  64. Texte

    Nouveau modèle

    InclusionAI Ling-3.0-Flash-VL sur

    Découvrez Ling-3.0-Flash-VL d'inclusionAI : un modèle MoE vision-langage de 124B paramètres disponible gratuitement sur OpenRouter.

    VisionFichiersOutilsRaisonnement
  65. Texte

    Nouveau modèle

    InclusionAI Ling-3.0-flash-VL

    Découvrez Ling-3.0-flash-VL, modèle MoE multimodal d'InclusionAI sous licence MIT, alliant vision, vidéo et raisonnement à coût réduit.

    VisionFichiersOutilsRaisonnement
  66. Texte

    Nouveau modèle

    Inception Inception Mercury 2.5

    Inception dévoile Mercury 2.5, un modèle de langage par diffusion (dLLM) alliant 260 000 tokens de contexte et une cadence de génération très élevée.

    OutilsRaisonnement
  67. Texte

    Nouveau modèle

    DeepSeek DeepSeek V4.1 Flash

    Découvrez DeepSeek-V4.1-Flash : architecture MoE asymétrique, contexte de 1 million de tokens et performances avancées pour le code et les agents.

    VisionOutilsRaisonnement
  68. Texte

    Nouveau modèle

    DeepSeek DeepSeek V4.1 Flash

    DeepSeek dévoile V4.1 Flash, un modèle MoE asymétrique de 552B paramètres optimisé pour les agents, le code et l'analyse visuelle jusqu'à 1M de tokens.

    VisionOutilsRaisonnement
  69. Texte

    Nouveau modèle

    Inception Inception Mercury 2.5

    Inception dévoile Mercury 2.5, un modèle de langage par diffusion conçu pour les agents textuels et l'inférence à haut débit.

    OutilsRaisonnement
  70. Texte

    Nouveau modèle

    DeepSeek DeepSeek V4.1 Flash

    DeepSeek dévoile V4.1 Flash, un modèle MoE multimodal de 552 Md de paramètres doté d'une fenêtre d'un million de tokens pour les flux agentiques.

    VisionOutilsRaisonnement
  71. Texte

    Nouveau modèle

    Inception Inception Mercury 2.5

    Découvrez Mercury 2.5 d'Inception, un modèle de langage par diffusion taillé pour les flux agentiques rapides et économiques.

    OutilsRaisonnement
  72. Texte

    Nouveau modèle

    DeepSeek DeepSeek V4.1 Flash

    Découvrez DeepSeek V4.1 Flash, un modèle MoE de 552 milliards de paramètres doté d'une fenêtre de contexte de 1 million de tokens.

    VisionOutilsRaisonnement
  73. Texte

    Nouveau modèle

    DeepSeek DeepSeek V4 Flash Vision Exp (Batch) sur

    Analyse technique de DeepSeek V4 Flash Vision Exp (Batch) sur OpenRouter : capacités visuelles, benchmarks, tarification et cycle de vie.

    VisionFichiersOutils
  74. Vidéo

    Nouveau modèle

    Black Forest Labs FLUX Video Edit

    Black Forest Labs lance FLUX Video Edit, un outil spécialisé dans la retouche vidéo précise par instruction textuelle, désormais répertorié sur OpenRouter.

    VisionFichiersGénération vidéoAudio
  75. Texte

    Nouveau modèle

    Google Antigravity-Preview-09-2026

    Analyse de l'identifiant antigravity-preview-09-2026 de Google : origines de la fuite, architecture agentique probable, limites et statut de déploiement.

    Outils
  76. Texte

    Nouveau modèle

    OpenAI GPT-Live-1

    Découvrez GPT-Live-1, le modèle vocal temps réel d'OpenAI doté d'une architecture full duplex et d'un système de délégation backend.

    OutilsSynthèse vocaleReconnaissance vocaleAudio
  77. Image

    Nouveau modèle

    OpenAI GPT Image 2.5 Sunburst

    Analyse technique de GPT-Image-2.5 Sunburst d'OpenAI, le modèle dédié à la génération visuelle haute fidélité et à la retouche multi-images exigeante.

    VisionGénération d'images
  78. Image

    Nouveau modèle

    OpenAI GPT-Image 2.5 Flare

    OpenAI dévoile GPT-Image-2.5 Flare, un modèle d'imagerie rapide réduisant la latence de 50 %, désormais activé et disponible sur notre plateforme.

    VisionGénération d'images
  79. Texte

    Nouveau modèle

    Qwen Qwen 3.8 Max (0902)

    Découvrez le snapshot Qwen3.8-Max-0902, un modèle MoE de 2 400 milliards de paramètres conçu pour le développement logiciel complexe et les agents autonomes.

    VisionFichiersOutilsRaisonnement
  80. Image

    Nouveau modèle

    Microsoft Mai Image 2.6 Flash

    Découvrez le modèle MAI-Image-2.6-Flash de Microsoft, conçu pour la génération d'images ultra-rapide et à grand volume en production.

    VisionFichiersGénération d'images

Liste de modèles fournie par la plateforme ProductivIA

productivia.ca