Seed 2.1 Turbo

Seed 2.1 Turbo est un LLM propriétaire de ByteDance, sorti le 24 juin 2026. Ses poids ne sont pas ouverts, ce qui le place dans la catégorie des modèles contrôlés par leur éditeur.

Seed 2.1 Turbo est un LLM propriétaire de ByteDance, sorti le 24 juin 2026. Ses poids ne sont pas ouverts, ce qui le place dans la catégorie des modèles contrôlés par leur éditeur.

À sa sortie, il se classait dans le top 10% des 86 LLM de sa génération sur Humanity's Last Exam. Ce résultat le situait dans le haut du panier des modèles parus au cours des quelque 18 mois précédents.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurByteDance
Poids🔒 Propriétaire
Date de sortie24 juin 2026
Multimodaloui

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
CharXiv-D94,6 %2ᵉ / 16llm-statsAuto-déclaré
MathVision92,7 %4ᵉ / 32llm-statsAuto-déclaré
MathVista90,5 %2ᵉ / 38llm-statsAuto-déclaré
Video-MME89,0 %2ᵉ / 17llm-statsAuto-déclaré
Beyond AIME88,0 %1ᵉ / 5llm-statsAuto-déclaré
RealWorldQA86,3 %3ᵉ / 25llm-statsAuto-déclaré
BrowseComp84,9 %9ᵉ / 57llm-statsAuto-déclaré
CharXiv-R83,6 %12ᵉ / 45llm-statsAuto-déclaré
GDPval82,7 %2ᵉ / 3llm-statsAuto-déclaré
EmbSpatialBench82,5 %8ᵉ / 8llm-statsAuto-déclaré
MMMU-Pro82,2 %5ᵉ / 64llm-statsAuto-déclaré
LongVideoBench80,6 %1ᵉ / 4llm-statsAuto-déclaré
MCP Atlas80,3 %6ᵉ / 30llm-statsAuto-déclaré
BLINK79,4 %2ᵉ / 13llm-statsAuto-déclaré
TVBench77,2 %3ᵉ / 3llm-statsAuto-déclaré
LVBench76,8 %2ᵉ / 23llm-statsAuto-déclaré
OSWorld76,4 %2ᵉ / 20llm-statsAuto-déclaré
FrontierScience Olympiad76,0 %1ᵉ / 3llm-statsAuto-déclaré
MotionBench74,8 %2ᵉ / 3llm-statsAuto-déclaré
ERQA71,3 %2ᵉ / 22llm-statsAuto-déclaré
OfficeQA Pro71,1 %2ᵉ / 7llm-statsAuto-déclaré
SimpleVQA71,1 %6ᵉ / 13llm-statsAuto-déclaré
DynaMath68,1 %7ᵉ / 7llm-statsAuto-déclaré
Terminal-Bench 2.167,6 %11ᵉ / 13llm-statsAuto-déclaré
VideoHolmes67,6 %2ᵉ / 3llm-statsAuto-déclaré
SuperGPQA67,4 %6ᵉ / 34llm-statsAuto-déclaré
CyberGym67,0 %8ᵉ / 9llm-statsAuto-déclaré
BabyVision62,9 %6ᵉ / 9llm-statsAuto-déclaré
OCRBench_V262,8 %4ᵉ / 7llm-statsAuto-déclaré
WildClawBench62,8 %1ᵉ / 4llm-statsAuto-déclaré
SciCode57,8 %3ᵉ / 18llm-statsAuto-déclaré
ZEROBench57,2 %1ᵉ / 9llm-statsAuto-déclaré
SWE-Bench Pro57,0 %22ᵉ / 41llm-statsAuto-déclaré
SuperChem56,6 %2ᵉ / 3llm-statsAuto-déclaré
Humanity's Last Exam54,6 %12ᵉ / 89llm-statsAuto-déclaré
VisuLogic52,9 %2ᵉ / 3llm-statsAuto-déclaré
Program Bench49,4 %5ᵉ / 5llm-statsAuto-déclaré
Toolathlon49,1 %15ᵉ / 30llm-statsAuto-déclaré
WorldVQA48,6 %4ᵉ / 5llm-statsAuto-déclaré
Artifacts Bench47,0 %2ᵉ / 3llm-statsAuto-déclaré
ClawEval-MM46,0 %3ᵉ / 3llm-statsAuto-déclaré
VisFactor43,9 %2ᵉ / 3llm-statsAuto-déclaré
NL2Repo43,7 %5ᵉ / 12llm-statsAuto-déclaré
MathArena Apex35,4 %5ᵉ / 7llm-statsAuto-déclaré
FrontierScience Research33,3 %2ᵉ / 4llm-statsAuto-déclaré
APEX-Agents29,2 %4ᵉ / 7llm-statsAuto-déclaré
DeepSWE23,0 %9ᵉ / 9llm-statsAuto-déclaré
PostTrainBench18,3 %4ᵉ / 5llm-statsAuto-déclaré
HorizonMath2,0 %2ᵉ / 3llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. Seed 2.1 Turbo se distingue par son classement sur Humanity's Last Exam. Lors de sa sortie, sa présence dans le top 10% indiquait un niveau compétitif face aux LLM contemporains évalués sur ce benchmark. Cette position constitue le principal élément concret pour situer ses performances à son époque.

Limites et points d'attention. La licence propriétaire et l'absence de poids ouverts restreignent l'examen direct du modèle, sa modification et son déploiement indépendant. L'évaluation disponible repose sur une seule source de données concordante et sur Humanity's Last Exam : le classement établit une performance élevée sur ce test, sans autoriser une généralisation à d'autres catégories de tâches. Seed 2.1 Turbo s'adresse donc principalement aux usages recherchant un LLM ByteDance bien classé sur ce benchmark, dans le cadre fixé par son éditeur.


Sources des données : LLM-Stats (llm-stats.com).