MiniMax M3

MiniMax M3 est un LLM multimodal natif lancé par MiniMax le 1 juin 2026. Entraîné conjointement sur le texte, l’image et la vidéo, il combine environ 428 milliards de paramètres au total avec 23 milliards de paramètres actifs. MiniMax Sparse Attention porte sa fenêtre de contexte à 1 048…

MiniMax M3 est un LLM multimodal natif lancé par MiniMax le 1 juin 2026. Entraîné conjointement sur le texte, l’image et la vidéo, il combine environ 428 milliards de paramètres au total avec 23 milliards de paramètres actifs. MiniMax Sparse Attention porte sa fenêtre de contexte à 1 048 576 tokens.

Le modèle se distingue par son orientation vers le codage, les tâches agentiques et le travail collaboratif. Ses poids ouverts sous licence MIT autorisent l’usage commercial et le déploiement local. Son positionnement est très économique, avec une tarification inférieure de 85% à la moyenne des LLM similaires.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurMiniMax
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceMIT
Date de sortie1 juin 2026
Multimodaloui
Paramètres actifs23 milliards
Fenêtre de contexte1 000 000 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text,image,video → text

Indices de synthèse

IndiceValeurRang (LLM)
Intelligence Index44.412ᵉ / 137
Code Index58.621ᵉ / 74
Agentic Index35.413ᵉ / 68

Indices Artificial Analysis. Le rang situe le modèle parmi tous les LLM du catalogue disposant de l'indice.

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
OmniDocBench 1.591,6 %1ᵉ / 13llm-statsAuto-déclaré
SpreadSheetBench-v189,3 %1ᵉ / 3llm-statsAuto-déclaré
USAMO 202685,7 %1ᵉ / 3llm-statsAuto-déclaré
Video-MME85,4 %6ᵉ / 17llm-statsAuto-déclaré
VideoMMMU84,6 %7ᵉ / 26llm-statsAuto-déclaré
BrowseComp83,5 %15ᵉ / 57llm-statsAuto-déclaré
SWE-Bench Verified80,5 %10ᵉ / 102llm-statsAuto-déclaré
MMMU-Pro78,1 %20ᵉ / 64llm-statsAuto-déclaré
Claw-Eval74,5 %3ᵉ / 13llm-statsAuto-déclaré
MCP Atlas74,2 %13ᵉ / 30llm-statsAuto-déclaré
OSWorld-Verified70,1 %13ᵉ / 19llm-statsAuto-déclaré
LiveBench70,0 %31ᵉ / 38llm-statsn.d.
Terminal-Bench 2.166,0 %12ᵉ / 13llm-statsAuto-déclaré
SWE-Bench Pro59,0 %13ᵉ / 41llm-statsAuto-déclaré
Finance Agent v248,3 %9ᵉ / 26llm-statsn.d.
GDPval-AA47,7 %11ᵉ / 39llm-statsn.d.
OfficeQA Pro45,1 %7ᵉ / 7llm-statsAuto-déclaré
NL2Repo42,1 %7ᵉ / 12llm-statsAuto-déclaré
PostTrainBench37,1 %1ᵉ / 5llm-statsAuto-déclaré
APEX-Agents27,7 %6ᵉ / 7llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Intelligence Index

▶ MiniMax M344.4
DeepSeek V4 Pro40.8

Code Index

▶ MiniMax M358.6
Grok Build 0.1 061651.5

Classements Arena (Elo)

CatégorieEloRangEn tête d'arène
Arena Code149321ᵉ / 99Kimi K3 (1679)
Arena Image-to-Code148116ᵉ / 31Claude Fable 5 (1627)
Arena Text144560ᵉ / 200Claude Fable 5 (1507)
Arena Document143520ᵉ / 32Claude Opus 4.6 (1508)
Arena Vision124236ᵉ / 135Claude Fable 5 (1318)

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
NovitaAI0,3 $1,2 $0,06 $
fireworks0,3 $1,2 $n.d.
minimax0,6 $2,4 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 86 % en dessous de la moyenne des LLM similaires, et 18,3 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,07 $
Latence moyenne par benchmark — Benchable22 min 26 s

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. MiniMax M3 se place dans le haut du classement de l’Intelligence Index et obtient également de bons rangs en Code Index et Agentic Index. À sa sortie, il figurait dans le top 9% des LLM de sa génération sur SWE-Bench Verified, ce qui confirme un positionnement solide pour l’ingénierie logicielle. Ses résultats en Coding et Reasoning sont élevés, tandis que l’Arena code le classe nettement mieux que les arènes textuelles et documentaires. Le contexte d’environ un million de tokens constitue un autre atout pour traiter de longs corpus. Trois modes de raisonnement, enabled, adaptive et disabled, permettent d’ajuster son fonctionnement. Le modèle est accessible par MiniMax Agent, MiniMax API ou en déploiement local avec plusieurs frameworks courants.

Limites et points d'attention. Les résultats sont moins homogènes hors du code. Le classement Ethics reste en retrait malgré un score Baseline élevé, et l’Arena document place MiniMax M3 dans la seconde moitié du panel. L’Arena text confirme un niveau compétitif sans atteindre les premières places. Son Elo en code demeure également inférieur à celui du leader. En contrepartie, son coût est particulièrement bas, environ 18,3 fois inférieur à celui des modèles frontière. MiniMax M3 cible ainsi surtout le codage, les agents, l’analyse de longs contextes et les déploiements commerciaux sensibles au budget.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Artificial Analysis (artificialanalysis.ai) · Arena.ai (arena.ai) · LiveBench (livebench.ai) · Benchable.ai (benchable.ai).