MiniMax M2.1

MiniMax M2.1 est un LLM de 230 milliards de paramètres publié par l’éditeur chinois MiniMax le 23 décembre 2025. Sa fenêtre de contexte de 1 000 000 tokens et son positionnement très économique le destinent aux tâches longues et complexes, notamment le codage, la planification et…

MiniMax M2.1 est un LLM de 230 milliards de paramètres publié par l’éditeur chinois MiniMax le 23 décembre 2025. Sa fenêtre de contexte de 1 000 000 tokens et son positionnement très économique le destinent aux tâches longues et complexes, notamment le codage, la planification et l’utilisation d’outils.

Le modèle cible le développement logiciel multilingue, les workflows bureautiques en plusieurs étapes et la création d’applications Web, Simulation, Android, iOS et Backend. Il est accessible par API, dans MiniMax Agent ou en déploiement local grâce à ses poids ouverts sous licence MIT, avec usage commercial autorisé.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurMiniMax
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceMIT
Date de sortie23 décembre 2025
Multimodalnon
Paramètres230 milliards
Fenêtre de contexte1 000 000 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
MMLU-Pro88,0 %4ᵉ / 125llm-statsAuto-déclaré
Tau2 Telecom87,0 %16ᵉ / 34llm-statsAuto-déclaré
AIME 202581,0 %64ᵉ / 108llm-statsAuto-déclaré
GPQA81,0 %73ᵉ / 219llm-statsAuto-déclaré
LiveCodeBench78,0 %14ᵉ / 72llm-statsAuto-déclaré
SWE-bench Multilingual72,5 %14ᵉ / 34llm-statsAuto-déclaré
IFBench70,0 %16ᵉ / 27llm-statsAuto-déclaré
SWE-Bench Verified67,0 %69ᵉ / 102llm-statsAuto-déclaré
AA-LCR62,0 %10ᵉ / 15llm-statsAuto-déclaré
BrowseComp62,0 %32ᵉ / 57llm-statsAuto-déclaré
Multi-SWE-Bench49,4 %3ᵉ / 6llm-statsAuto-déclaré
Terminal-Bench47,9 %2ᵉ / 25llm-statsAuto-déclaré
Toolathlon43,5 %21ᵉ / 30llm-statsAuto-déclaré
SciCode39,0 %12ᵉ / 18llm-statsAuto-déclaré
Humanity's Last Exam22,0 %53ᵉ / 89llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
NovitaAI0,3 $1,2 $0,03 $
minimax0,3 $1,2 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 86 % en dessous de la moyenne des LLM similaires, et 18,3 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,11 $
Latence moyenne par benchmark — Benchable21 min 46 s

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Entraînement & empreinte

IndicateurValeur
PaysChina

Notre analyse

Forces. MiniMax M2.1 obtient ses meilleurs classements relatifs en classification d’e-mails et en codage, deux domaines où il se place près du premier dixième des modèles évalués par Benchable. Ses résultats sont également élevés en connaissances générales, raisonnement et éthique, même si ses rangs y sont moins favorables. À sa sortie, il figurait dans le top 20% des LLM de sa génération sur GPQA. Sa fenêtre de contexte de 1 000 000 tokens soutient les workflows étendus, tandis que ses orientations techniques couvrent le suivi d’instructions, la planification à long horizon, l’utilisation d’outils et le développement logiciel sur plusieurs plateformes. Son tarif est 85% inférieur à la moyenne des LLM similaires et environ 18,3 fois inférieur à celui des modèles frontière.

Limites et points d’attention. Le score sur les hallucinations paraît élevé en valeur absolue, mais son classement se situe dans la partie basse du panel Benchable. Les résultats en éthique et en connaissances générales restent eux aussi moins distinctifs que ceux obtenus en classification d’e-mails et en codage. Avec 230 milliards de paramètres, un déploiement local implique par ailleurs un modèle de grande taille. MiniMax M2.1 convient surtout aux projets sensibles au coût, aux longues fenêtres de contexte, au codage multilingue et aux automatisations complexes en plusieurs étapes.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Epoch AI (epoch.ai), CC-BY-4.0 · Benchable.ai (benchable.ai).