Mistral Large 3
Mistral Large 3 est un LLM open-weights publié par Mistral AI le 1 septembre 2025. Ses 675 milliards de paramètres le placent parmi les modèles de très grande taille, tandis que sa fenêtre de contexte atteint 128 000 tokens.
Mistral Large 3 est un LLM open-weights publié par Mistral AI le 1 septembre 2025. Ses 675 milliards de paramètres le placent parmi les modèles de très grande taille, tandis que sa fenêtre de contexte atteint 128 000 tokens.
Distribué sous licence Apache 2.0, il autorise les usages commerciaux. Son profil associe une performance mathématique élevée à sa sortie à des résultats nettement moins favorables dans les évaluations comparatives générales et en programmation.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | Mistral AI |
| Poids | 🟢 Poids ouverts · usage commercial autorisé |
| Licence | Apache 2.0 |
| Date de sortie | 1 septembre 2025 |
| Multimodal | oui |
| Paramètres | 675 milliards |
| Fenêtre de contexte | 128 000 tokens |
| Modalités (entrée → sortie) | text,image → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| MATH | 90,4 % | 3ᵉ / 70 | llm-stats | Auto-déclaré |
| MM-MT-Bench | 84,9 % | 1ᵉ / 17 | llm-stats | Auto-déclaré |
| MMLU-Redux | 82,0 % | 36ᵉ / 48 | llm-stats | Auto-déclaré |
| TriviaQA | 74,9 % | 9ᵉ / 18 | llm-stats | Auto-déclaré |
| MMMLU | 74,2 % | 43ᵉ / 49 | llm-stats | Auto-déclaré |
| Wild Bench | 68,5 % | 1ᵉ / 8 | llm-stats | Auto-déclaré |
| MATH (CoT) | 67,6 % | 2ᵉ / 6 | llm-stats | Auto-déclaré |
| Arena Hard | 55,1 % | 16ᵉ / 26 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Classements Arena (Elo)
| Catégorie | Elo | Rang | En tête d'arène |
|---|---|---|---|
| Arena Text | 1416 | 107ᵉ / 200 | Claude Fable 5 (1507) |
| Arena Image-to-Code | 1307 | 30ᵉ / 31 | Claude Fable 5 (1627) |
| Arena Code | 1224 | 91ᵉ / 99 | Kimi K3 (1679) |
| Arena Vision | 1203 | 60ᵉ / 135 | Claude Fable 5 (1318) |
Notre analyse
Forces. À sa sortie, Mistral Large 3 figurait dans le top 5% sur MATH parmi les 63 LLM de sa génération, soit les modèles publiés durant les quelque 18 mois précédents. Ce résultat en fait avant tout un modèle notable pour les évaluations de raisonnement mathématique de son époque. Sa fenêtre de 128 000 tokens offre aussi une capacité de contexte étendue. Enfin, la licence Apache 2.0 et la disponibilité open-weights autorisent l’exploitation commerciale du modèle.
Limites et points d'attention. Les résultats Arena nuancent fortement ce positionnement. En texte, Mistral Large 3 se situe dans la seconde moitié du classement, loin du modèle en tête. Sur Arena Code, il apparaît près du bas du tableau, avec un écart particulièrement important face au meilleur modèle évalué. Le nombre très élevé de paramètres implique par ailleurs un modèle particulièrement volumineux. Ces constats reposent sur deux sources de données concordantes. Mistral Large 3 vise surtout les projets privilégiant les poids ouverts, la licence commerciale, un contexte étendu et un bon niveau en mathématiques, plutôt que les meilleures performances comparatives en texte ou en code.
Sources des données : LLM-Stats (llm-stats.com) · Arena.ai (arena.ai).