MiMo-V2-Omni
MiMo-V2-Omni est un LLM propriétaire de Xiaomi, lancé le 18 mars 2026. Son positionnement associe traitement du texte et de la vision, avec des résultats mesurés dans les deux catégories de l’Arena.
MiMo-V2-Omni est un LLM propriétaire de Xiaomi, lancé le 18 mars 2026. Son positionnement associe traitement du texte et de la vision, avec des résultats mesurés dans les deux catégories de l’Arena.
Sa fenêtre de contexte de 262 144 tokens constitue l’une de ses caractéristiques centrales, adaptée au traitement de contenus volumineux. À sa sortie, ses performances sur SWE-Bench Verified le plaçaient dans le top 27% des LLM de sa génération, un résultat solide pour les tâches de développement logiciel évaluées par ce benchmark.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | Xiaomi |
| Poids | 🔒 Propriétaire |
| Date de sortie | 18 mars 2026 |
| Multimodal | oui |
| Fenêtre de contexte | 262 000 tokens |
| Modalités (entrée → sortie) | text,image,audio,video → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| PinchBench | 81,2 % | 2ᵉ / 4 | llm-stats | Auto-déclaré |
| SWE-Bench Verified | 74,8 % | 34ᵉ / 102 | llm-stats | Auto-déclaré |
| Claw-Eval | 54,8 % | 12ᵉ / 13 | llm-stats | Auto-déclaré |
| GDPval-AA | 47,0 % | 15ᵉ / 39 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Classements Arena (Elo)
Arena Text · 200 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Fable 5 | 1507 |
| 2ᵉ | Claude Opus 4.6 | 1504 |
| 3ᵉ | Claude Opus 4.7 | 1503 |
| ⋯ | ⋯ | |
| 81ᵉ | Grok 4.1 Fast | 1431 |
| 82ᵉ | o3 | 1431 |
| 83ᵉ | MiMo-V2-Omni | 1430 |
| 84ᵉ | Kimi K2 0905 | 1430 |
| 85ᵉ | Mistral Medium 3.5 | 1427 |
Arena Vision · 135 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Fable 5 | 1318 |
| 2ᵉ | Claude Opus 4.7 | 1304 |
| 3ᵉ | Claude Opus 4.6 | 1299 |
| ⋯ | ⋯ | |
| 48ᵉ | Gemini 2.5 Flash Preview | 1225 |
| 49ᵉ | Qwen3.5-27B | 1220 |
| 50ᵉ | MiMo-V2-Omni | 1218 |
| 51ᵉ | ernie-5.0-preview-1220 | 1218 |
| 52ᵉ | o3 | 1216 |
Notre analyse
Forces. MiMo-V2-Omni se situait à sa sortie dans le quart supérieur élargi de sa génération sur SWE-Bench Verified, qui évalue la résolution de problèmes logiciels réels. Ses classements Arena le placent également dans la première moitié des modèles évalués en texte comme en vision. Cette polyvalence est complétée par une fenêtre de contexte de 262 144 tokens, utile pour analyser de longs documents, des historiques étendus ou d’importants volumes de code au sein d’une même requête.
Limites et points d'attention. MiMo-V2-Omni reste sensiblement derrière le modèle en tête dans les deux classements Arena. Son rang est plus favorable en vision qu’en texte, mais il n’intègre le groupe de tête dans aucune de ces catégories. Sa licence propriétaire et ses poids non ouverts excluent l’inspection, la modification ou l’hébergement autonome des poids. Le modèle correspond surtout aux usages combinant contexte long, texte et vision, lorsque l’accès à des poids ouverts n’est pas une exigence.
Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Arena.ai (arena.ai).