MiniMax M1

Publié par MiniMax le 17 juin 2025, MiniMax M1 est un LLM de raisonnement à poids ouverts. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont aujourd’hui largement dépassées.

Publié par MiniMax le 17 juin 2025, MiniMax M1 est un LLM de raisonnement à poids ouverts. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont aujourd’hui largement dépassées.

Le modèle combine une architecture Mixture-of-Experts, une attention hybride et un mécanisme « lightning attention ». Sa fenêtre de contexte atteint 1 million de tokens. Son positionnement très économique et ses poids ouverts constituent ses principaux signes distinctifs, avec des connaissances arrêtées au 30 juin 2024.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurMiniMax
Poids🟢 Poids ouverts
Date de sortie17 juin 2025
Connaissances jusqu'à2024-06-30
Multimodalnon
Fenêtre de contexte1 000 000 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Benchable : Email Classification (Baseline)100,0 %1ᵉ / 163benchable✅ Mesuré
Benchable : General Knowledge (Baseline)99,8 %43ᵉ / 161benchable✅ Mesuré
Benchable : Ethics (Baseline)99,0 %73ᵉ / 159benchable✅ Mesuré
Benchable : Reasoning (Baseline)93,9 %48ᵉ / 155benchable✅ Mesuré
Benchable : Coding (Baseline)91,0 %66ᵉ / 162benchable✅ Mesuré
Benchable : Hallucinations (Baseline)89,8 %94ᵉ / 146benchable✅ Mesuré
Benchable : Mathematics (Baseline)87,5 %85ᵉ / 140benchable✅ Mesuré
Benchable : Instruction Following (Baseline)62,6 %79ᵉ / 163benchable✅ Mesuré
MATH-50096,0 %15ᵉ / 31llm-statsAuto-déclaré
AIME 202483,3 %19ᵉ / 52llm-statsAuto-déclaré
MMLU-Pro80,6 %49ᵉ / 125llm-statsAuto-déclaré
ZebraLogic80,1 %7ᵉ / 7llm-statsAuto-déclaré
OpenAI-MRCR: 2 needle 128k76,1 %2ᵉ / 8llm-statsAuto-déclaré
AIME 202574,6 %74ᵉ / 108llm-statsAuto-déclaré
GPQA69,2 %121ᵉ / 219llm-statsAuto-déclaré
TAU-bench Retail67,8 %15ᵉ / 24llm-statsAuto-déclaré
LiveCodeBench62,3 %31ᵉ / 72llm-statsAuto-déclaré
LongBench v261,0 %4ᵉ / 15llm-statsAuto-déclaré
TAU-bench Airline60,0 %4ᵉ / 22llm-statsAuto-déclaré
OpenAI-MRCR: 2 needle 1M58,6 %1ᵉ / 4llm-statsAuto-déclaré
SWE-Bench Verified55,6 %81ᵉ / 102llm-statsAuto-déclaré
Multi-Challenge44,7 %18ᵉ / 28llm-statsAuto-déclaré
SimpleQA17,9 %35ᵉ / 45llm-statsAuto-déclaré
Humanity's Last Exam7,2 %82ᵉ / 89llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Benchable : Email Classification (Baseline)

hermes-3-llama-3.1-405b100 %
▶ MiniMax M1100 %

Benchable : General Knowledge (Baseline)

▶ MiniMax M1100 %

Classements Arena (Elo)

Arena Text · 200 modèles classés

RangModèleElo
1ᵉClaude Fable 51507
2ᵉClaude Opus 4.61504
3ᵉClaude Opus 4.71503
165ᵉamazon-nova-experimental-chat-11-101366
166ᵉGemma 3 27B1366
167ᵉMiniMax M11364
168ᵉo3-mini1363
169ᵉGrok-3 Mini1362

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
MiniMax0,4 $2,2 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 81 % en dessous de la moyenne des LLM similaires, et 13,8 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,23 $
Latence moyenne par benchmark — Benchable2 h 20 min

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. À sa sortie, MiniMax M1 figurait dans le top 25% des LLM de sa génération sur GPQA. Son résultat en Reasoning le plaçait dans le premier tiers du classement Benchable, tandis que Coding se situait dans la première moitié. En Email Classification, il partage la première place avec neuf autres modèles, sur un test arrivé à saturation. La fenêtre de contexte de 1 million de tokens reste notable. Le tarif se situe 81% sous la moyenne des LLM similaires et environ 13,8 fois sous celui des modèles frontière.

Limites et points d’attention. Les benchmarks plafonnés, notamment Email Classification et General Knowledge, départagent mal les modèles. MiniMax M1 apparaît en retrait sur Hallucinations et surtout dans l’Arena text, où il occupe le rang 167 sur 200 avec un Elo de 1364. Il se place derrière Claude Fable 5, Claude Opus 4.6 et Claude Opus 4.7. Claude Fable 5 est nettement devant en duel. Son ancienneté et sa coupure des connaissances au 30 juin 2024 limitent aussi son intérêt actuel, tandis que les modèles de cette période sont souvent retirés des catalogues. Il conserve un intérêt pour l’étude d’une architecture de raisonnement à poids ouverts et à très long contexte. Pour un résultat plus abouti, on lui préférera Claude Fable 5, Claude Opus 4.6 ou Claude Opus 4.7.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Arena.ai (arena.ai) · Benchable.ai (benchable.ai).