MiniMax M2.5

MiniMax M2.5 est un LLM à poids ouverts publié par MiniMax le 12 février 2026 sous licence MIT, avec usage commercial autorisé. Il combine 230 milliards de paramètres, dont 10 milliards actifs, et une fenêtre de contexte de 1 000 000 tokens.

MiniMax M2.5 est un LLM à poids ouverts publié par MiniMax le 12 février 2026 sous licence MIT, avec usage commercial autorisé. Il combine 230 milliards de paramètres, dont 10 milliards actifs, et une fenêtre de contexte de 1 000 000 tokens.

Son positionnement associe codage, recherche, usage agentique d’outils, tâches bureautiques et décomposition de problèmes. Son entraînement par renforcement s’appuie sur des centaines de milliers d’environnements complexes inspirés du monde réel. Le modèle couvre notamment Go, C, C++, TypeScript, Rust, Python, Java et JavaScript, ainsi que des projets Web, mobiles et Windows.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurMiniMax
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceMIT
Date de sortie12 février 2026
Multimodalnon
Paramètres230 milliards
Paramètres actifs10 milliards
Fenêtre de contexte1 000 000 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text,image → text

Indices de synthèse

IndiceValeurRang (LLM)
Intelligence Index33.744ᵉ / 137

Indices Artificial Analysis. Le rang situe le modèle parmi tous les LLM du catalogue disposant de l'indice.

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
SWE-Bench Verified80,2 %12ᵉ / 102llm-statsAuto-déclaré
BrowseComp76,3 %23ᵉ / 57llm-statsAuto-déclaré
GDPval-MM59,0 %3ᵉ / 3llm-statsAuto-déclaré
SWE-Bench Pro55,4 %28ᵉ / 41llm-statsAuto-déclaré
Multi-SWE-Bench51,3 %2ᵉ / 6llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Intelligence Index

Nemotron 3 Ultra 550B A…37.8
▶ MiniMax M2.533.7
Qwen3.5 397B A17B32.0

Classements Arena (Elo)

Arena Text · 200 modèles classés

RangModèleElo
1ᵉClaude Fable 51507
2ᵉClaude Opus 4.61504
3ᵉClaude Opus 4.71503
137ᵉamazon-nova-experimental-chat-12-101394
138ᵉMiMo-V2-Flash1393
139ᵉMiniMax M2.51391
140ᵉGPT-5 mini1390
141ᵉo4-mini1390

Arena Code · 99 modèles classés

RangModèleElo
1ᵉKimi K31679
2ᵉClaude Fable 51631
3ᵉGPT-5.6 Sol1618
57ᵉClaude Opus 4.11386
58ᵉGPT-4.51386
59ᵉMiniMax M2.51382
60ᵉGrok-4.20 Beta1381
61ᵉGPT-5.3 Codex1371

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
Inceptron0,15 $0,9 $0,05 $
minimax0,3 $1,2 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 93 % en dessous de la moyenne des LLM similaires, et 36,7 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,06 $
Latence moyenne par benchmark — Benchable12 min 34 s

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. MiniMax M2.5 atteint le premier rang des tests Benchable de connaissances générales et d’éthique. Ses résultats restent élevés en classification d’e-mails, raisonnement, codage et mathématiques, même si les rangs associés sont moins favorables. À sa sortie, il figurait dans le top 5% des LLM de sa génération sur SWE-Bench Verified, ce qui souligne sa compétitivité initiale pour le développement logiciel. Sa formation couvre plus de 10 langages et l’ensemble du cycle logiciel, avec des projets Web, Android, iOS et Windows. La fenêtre d’un million de tokens favorise le traitement de corpus volumineux. MiniMax Agent, API, MCP, Hugging Face API, GitHub et ModelScope constituent ses principaux modes d’accès.

Limites et points d'attention. L’Intelligence Index ne le place pas parmi les modèles les mieux classés, tandis que les Arena text et Arena code le situent dans la seconde moitié de leurs classements respectifs. Les scores Benchable élevés doivent donc être nuancés par ces évaluations comparatives, notamment en mathématiques, où son rang est plus faible. Son principal avantage concurrentiel reste économique : sa tarification se situe 92% sous la moyenne des LLM similaires et environ 36.7 fois sous celle des modèles frontière. MiniMax M2.5 cible ainsi les usages de codage, d’automatisation agentique, de recherche et de traitement de longs contextes soumis à de fortes contraintes budgétaires.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Artificial Analysis (artificialanalysis.ai) · Arena.ai (arena.ai) · Benchable.ai (benchable.ai).