Seed 2.1 Turbo
Seed 2.1 Turbo est un LLM propriétaire de ByteDance, sorti le 24 juin 2026. Ses poids ne sont pas ouverts, ce qui le place dans la catégorie des modèles contrôlés par leur éditeur.
Seed 2.1 Turbo est un LLM propriétaire de ByteDance, sorti le 24 juin 2026. Ses poids ne sont pas ouverts, ce qui le place dans la catégorie des modèles contrôlés par leur éditeur.
À sa sortie, il se classait dans le top 10% des 86 LLM de sa génération sur Humanity's Last Exam. Ce résultat le situait dans le haut du panier des modèles parus au cours des quelque 18 mois précédents.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | ByteDance |
| Poids | 🔒 Propriétaire |
| Date de sortie | 24 juin 2026 |
| Multimodal | oui |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| CharXiv-D | 94,6 % | 2ᵉ / 16 | llm-stats | Auto-déclaré |
| MathVision | 92,7 % | 4ᵉ / 32 | llm-stats | Auto-déclaré |
| MathVista | 90,5 % | 2ᵉ / 38 | llm-stats | Auto-déclaré |
| Video-MME | 89,0 % | 2ᵉ / 17 | llm-stats | Auto-déclaré |
| Beyond AIME | 88,0 % | 1ᵉ / 5 | llm-stats | Auto-déclaré |
| RealWorldQA | 86,3 % | 3ᵉ / 25 | llm-stats | Auto-déclaré |
| BrowseComp | 84,9 % | 9ᵉ / 57 | llm-stats | Auto-déclaré |
| CharXiv-R | 83,6 % | 12ᵉ / 45 | llm-stats | Auto-déclaré |
| GDPval | 82,7 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
| EmbSpatialBench | 82,5 % | 8ᵉ / 8 | llm-stats | Auto-déclaré |
| MMMU-Pro | 82,2 % | 5ᵉ / 64 | llm-stats | Auto-déclaré |
| LongVideoBench | 80,6 % | 1ᵉ / 4 | llm-stats | Auto-déclaré |
| MCP Atlas | 80,3 % | 6ᵉ / 30 | llm-stats | Auto-déclaré |
| BLINK | 79,4 % | 2ᵉ / 13 | llm-stats | Auto-déclaré |
| TVBench | 77,2 % | 3ᵉ / 3 | llm-stats | Auto-déclaré |
| LVBench | 76,8 % | 2ᵉ / 23 | llm-stats | Auto-déclaré |
| OSWorld | 76,4 % | 2ᵉ / 20 | llm-stats | Auto-déclaré |
| FrontierScience Olympiad | 76,0 % | 1ᵉ / 3 | llm-stats | Auto-déclaré |
| MotionBench | 74,8 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
| ERQA | 71,3 % | 2ᵉ / 22 | llm-stats | Auto-déclaré |
| OfficeQA Pro | 71,1 % | 2ᵉ / 7 | llm-stats | Auto-déclaré |
| SimpleVQA | 71,1 % | 6ᵉ / 13 | llm-stats | Auto-déclaré |
| DynaMath | 68,1 % | 7ᵉ / 7 | llm-stats | Auto-déclaré |
| Terminal-Bench 2.1 | 67,6 % | 11ᵉ / 13 | llm-stats | Auto-déclaré |
| VideoHolmes | 67,6 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
| SuperGPQA | 67,4 % | 6ᵉ / 34 | llm-stats | Auto-déclaré |
| CyberGym | 67,0 % | 8ᵉ / 9 | llm-stats | Auto-déclaré |
| BabyVision | 62,9 % | 6ᵉ / 9 | llm-stats | Auto-déclaré |
| OCRBench_V2 | 62,8 % | 4ᵉ / 7 | llm-stats | Auto-déclaré |
| WildClawBench | 62,8 % | 1ᵉ / 4 | llm-stats | Auto-déclaré |
| SciCode | 57,8 % | 3ᵉ / 18 | llm-stats | Auto-déclaré |
| ZEROBench | 57,2 % | 1ᵉ / 9 | llm-stats | Auto-déclaré |
| SWE-Bench Pro | 57,0 % | 22ᵉ / 41 | llm-stats | Auto-déclaré |
| SuperChem | 56,6 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
| Humanity's Last Exam | 54,6 % | 12ᵉ / 89 | llm-stats | Auto-déclaré |
| VisuLogic | 52,9 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
| Program Bench | 49,4 % | 5ᵉ / 5 | llm-stats | Auto-déclaré |
| Toolathlon | 49,1 % | 15ᵉ / 30 | llm-stats | Auto-déclaré |
| WorldVQA | 48,6 % | 4ᵉ / 5 | llm-stats | Auto-déclaré |
| Artifacts Bench | 47,0 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
| ClawEval-MM | 46,0 % | 3ᵉ / 3 | llm-stats | Auto-déclaré |
| VisFactor | 43,9 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
| NL2Repo | 43,7 % | 5ᵉ / 12 | llm-stats | Auto-déclaré |
| MathArena Apex | 35,4 % | 5ᵉ / 7 | llm-stats | Auto-déclaré |
| FrontierScience Research | 33,3 % | 2ᵉ / 4 | llm-stats | Auto-déclaré |
| APEX-Agents | 29,2 % | 4ᵉ / 7 | llm-stats | Auto-déclaré |
| DeepSWE | 23,0 % | 9ᵉ / 9 | llm-stats | Auto-déclaré |
| PostTrainBench | 18,3 % | 4ᵉ / 5 | llm-stats | Auto-déclaré |
| HorizonMath | 2,0 % | 2ᵉ / 3 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Notre analyse
Forces. Seed 2.1 Turbo se distingue par son classement sur Humanity's Last Exam. Lors de sa sortie, sa présence dans le top 10% indiquait un niveau compétitif face aux LLM contemporains évalués sur ce benchmark. Cette position constitue le principal élément concret pour situer ses performances à son époque.
Limites et points d'attention. La licence propriétaire et l'absence de poids ouverts restreignent l'examen direct du modèle, sa modification et son déploiement indépendant. L'évaluation disponible repose sur une seule source de données concordante et sur Humanity's Last Exam : le classement établit une performance élevée sur ce test, sans autoriser une généralisation à d'autres catégories de tâches. Seed 2.1 Turbo s'adresse donc principalement aux usages recherchant un LLM ByteDance bien classé sur ce benchmark, dans le cadre fixé par son éditeur.
Sources des données : LLM-Stats (llm-stats.com).