Texte

MiniMax

Minimax M3:batch

MiniMax M3 (:batch), un modèle multimodal à poids ouverts optimisé pour les agents, le code et le traitement asynchrone à coût réduit.

Dernière version
MiniMax M3 Batch
Type
Texte
Versions recensées
1

Ce que fait ce modèle

Le paysage des modèles d'intelligence artificielle à poids ouverts s'enrichit d'une proposition particulièrement robuste avec l'arrivée de MiniMax M3. Officiellement annoncé par le fournisseur MiniMax le 1er juin 2026, et répertorié sur le catalogue d'OpenRouter dès le 31 mai 2026 — un décalage mineur imputable aux délais de déploiement —, ce modèle se positionne comme un outil de premier plan pour les tâches complexes de raisonnement et de programmation agentique. La déclinaison spécifique minimax/minimax-m3:batch proposée par OpenRouter cible spécifiquement les charges de travail asynchrones ou non sensibles à la latence, offrant une alternative économique sans compromis sur l'architecture sous-jacente.

Architecture et modalités : une approche native et optimisée

MiniMax M3 se distingue par sa nature multimodale native. En entrée, le modèle est capable de traiter simultanément du texte, des images et des vidéos. En sortie, il produit exclusivement du texte. Il convient de noter que, selon les spécifications actuelles, l'audio n'est pas pris en charge en entrée, et le modèle ne génère aucun contenu multimédia (ni image, ni vidéo, ni audio).

L'innovation architecturale majeure repose sur la technologie MSA (MiniMax Sparse Attention). Contrairement aux mécanismes d'attention dense traditionnels qui analysent l'intégralité du contexte à chaque étape, l'architecture MSA sélectionne de manière dynamique des blocs de clés-valeurs (KV). Cette approche permet d'obtenir des gains substantiels en matière de ressources de calcul et de vitesse d'exécution, particulièrement lors du traitement de contextes très longs.

Cependant, une distinction technique importante doit être soulignée concernant la fenêtre de contexte. Alors que la version standard de MiniMax M3 est annoncée avec une capacité maximale de 1 048 576 tokens (1 M), la variante minimax/minimax-m3:batch disponible via l'API publique d'OpenRouter est actuellement limitée à une fenêtre effective de 524 288 tokens. De plus, la limite maximale de tokens en sortie pour cette version batch reste publiquement inconnue (indiquée comme null par OpenRouter), et ne doit pas être assimilée par défaut aux 512 000 tokens de complétion de l'endpoint standard.

Positionnement et performances : un modèle taillé pour les agents

MiniMax oriente résolument son modèle M3 vers les cas d'usage avancés liés au code et au déploiement d'agents autonomes. Les évaluations fournies par le concepteur affichent des scores impressionnants sur plusieurs benchmarks de référence : - SWE-Bench Pro : 59,0 % - Terminal-Bench 2.1 : 66,0 % - MCP Atlas : 74,2 % - SWE-fficiency : 34,8 % - KernelBench Hard : 28,8 %

Selon le fournisseur, ces résultats placent MiniMax M3 à un niveau proche des modèles propriétaires les plus avancés du marché pour la correction de bugs, le développement logiciel (front-end et back-end) et l'optimisation des performances applicatives. Il convient toutefois d'aborder ces chiffres avec la rigueur nécessaire : une part importante de ces évaluations a été réalisée sur l'infrastructure propre de MiniMax et en utilisant ses propres structures d'échafaudage (scaffolds). Ces mesures ne constituent donc pas des évaluations indépendantes et strictement homogènes.

Cas d'usage concrets et limites

L'offre tarifaire de la variante :batch s'avère particulièrement attractive pour des scénarios industriels spécifiques. Avec un coût de 0,15 $ par million de tokens d'entrée, 0,60 $ par million de tokens de sortie, et seulement 0,03 $ par million de tokens lus depuis le cache (soit une réduction de moitié par rapport aux tarifs du modèle M3 standard), cette version est idéale pour : - Le traitement par lots de grands corpus documentaires textuels. - L'analyse approfondie de dépôts de code complexes et l'audit logiciel. - Les workflows d'agents outillés nécessitant des appels d'outils successifs et de la programmation agentique. - L'extraction d'informations et le raisonnement logique sur des documents visuels ou des interfaces graphiques. - L'analyse de séquences vidéo pour la détection d'événements ou la synthèse de contenu.

Malgré ces atouts, les utilisateurs doivent composer avec certaines limites. L'absence de capacités audio et de génération multimédia restreint son usage à des interfaces textuelles. De plus, la réduction de la fenêtre de contexte à 524 k tokens pour l'offre batch et l'incertitude quant au plafond de génération de sortie imposent une phase de qualification technique rigoureuse avant tout déploiement en production. Pour les applications critiques, une validation empirique des performances sur vos propres jeux de données et environnements reste indispensable.

Capacités

Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.

Texte

Type principal de contenu traité ou produit par ce modèle.

Vision

Analyse d'images fournies en entrée (photos, captures, documents visuels).

Outils

Peut appeler des outils ou des fonctions (recherche, calcul, actions).

Historique des versions

1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.

  1. Date non communiquée

    MiniMax M3 Batch

    Dernière version

    minimax/minimax-m3:batch

    VisionOutils
    Fenêtre de contexte (Batch)
    524 288 tokens
    Tarif Entrée / Mégatoken
    0,15 $
    Tarif Sortie / Mégatoken
    0,60 $
    Tarif Cache / Mégatoken
    0,03 $
    Architecture d'attention
    MSA (MiniMax Sparse Attention)
    Entrées prises en charge
    Texte, Image, Vidéo

    Tarif annoncé : 0.30 $ en entrée, 1.20 $ en sortie, par million de jetons (USD)

Liste de modèles fournie par la plateforme ProductivIA

productivia.ca