VBench: Actions humaines

VBench: Actions humaines est une dimension de la suite VBench, créée en 2023 par Vchitect et les auteurs de VBench pour évaluer les modèles de génération vidéo. Elle examine la fidélité avec laquelle un système texte-vers-vidéo représente une action humaine formulée en anglais.

VBench: Actions humaines est une dimension de la suite VBench, créée en 2023 par Vchitect et les auteurs de VBench pour évaluer les modèles de génération vidéo. Elle examine la fidélité avec laquelle un système texte-vers-vidéo représente une action humaine formulée en anglais.

À partir de prompts textuels, les vidéos produites sont évaluées automatiquement par reconnaissance et classification des actions. Cette dimension joue un rôle diagnostique ciblé dans VBench, en isolant la compréhension et la restitution visuelle des mouvements humains demandés.

Carte d'identité

CaractéristiqueValeur
Éditeur du benchmarkVchitect / auteurs de VBench
Capacités mesuréesMesure la capacité d’un modèle texte-vers-vidéo à générer des vidéos montrant correctement l’action humaine demandée dans le prompt.
ModalitéVidéo
Type de questionsprompts textuels de génération vidéo évalués automatiquement
Métrique d'évaluationscore VBench normalisé entre 0 et 1, basé sur la reconnaissance/classification d’actions humaines
AccèsPublic
Languesanglais
Année de publication2023
RessourcesSite / dépôt officiel · Article scientifique

Métadonnées descriptives pré-renseignées automatiquement, en cours de relecture éditoriale.

Classement des modèles (62)

#ModèleÉditeurLicenceScoreSortieFiabilité
1CausVid▫ n.d.99,8 %2 janvier 2025✅ Mesuré
2Vidu Q1Shengshu▫ n.d.99,6 %21 avril 2025✅ Mesuré
3CogVideoX-5BZhipu AI▫ n.d.99,4 %4 mars 2025✅ Mesuré
4IPOC▫ n.d.99,4 %14 avril 2025✅ Mesuré
5veo-3Google▫ n.d.99,4 %21 mai 2025✅ Mesuré
6Wan2.1Qwen▫ n.d.98,8 %24 février 2025✅ Mesuré
7soraOpenAI🔒 Propriétaire98,2 %15 février 2024✅ Mesuré
8CogVideoX-2BZhipu AI▫ n.d.98,0 %3 mars 2025✅ Mesuré
9MiracleVision V5▫ n.d.98,0 %21 janvier 2025✅ Mesuré
10RepVideo▫ n.d.98,0 %16 janvier 2025✅ Mesuré
11CogVideoX1.5-5BZhipu AI▫ n.d.97,6 %15 novembre 2024✅ Mesuré
12JT3.5▫ n.d.97,4 %30 juillet 2025✅ Mesuré
13ViduShengshu▫ n.d.97,4 %15 novembre 2024✅ Mesuré
14Vchitect-2.0▫ n.d.97,2 %20 septembre 2024✅ Mesuré
15IPOW▫ n.d.97,0 %6 août 2025✅ Mesuré
16Vchitect-2.0-2B▫ n.d.97,0 %16 septembre 2024✅ Mesuré
17LaVie▫ n.d.96,8 %23 novembre 2023✅ Mesuré
18LanDiff▫ n.d.96,6 %6 août 2025✅ Mesuré
19Gen-3Runway🔒 Propriétaire96,4 %25 juillet 2024✅ Mesuré
20LumaLuma AI🔒 Propriétaire96,4 %14 janvier 2025✅ Mesuré
21Kling 1.6Kuaishou🔒 Propriétaire96,2 %8 mai 2025✅ Mesuré
22LaVie-Interpolation▫ n.d.95,8 %17 février 2024✅ Mesuré
23AccVideo▫ n.d.95,6 %31 mars 2025✅ Mesuré
24EasyAnimateV5.1▫ n.d.95,6 %22 janvier 2025✅ Mesuré
25STIV▫ n.d.95,6 %19 décembre 2024✅ Mesuré
26Show-1▫ n.d.95,6 %19 janvier 2024✅ Mesuré
27Open-Sora-2.0HPC-AI Tech▫ n.d.95,4 %31 mars 2025✅ Mesuré
28Wan2.1-T2V-14BQwen▫ n.d.95,4 %25 juillet 2025✅ Mesuré
29VideoCrafter-2.0▫ n.d.95,0 %19 avril 2024✅ Mesuré
30Mochi-1Genmo▫ n.d.94,6 %7 novembre 2024✅ Mesuré
31Hunyuan VideoTencent▫ n.d.94,4 %22 mai 2025✅ Mesuré
32Step-Video-T2V▫ n.d.94,0 %13 mars 2025✅ Mesuré
33Wan2.1-T2V-1.3BQwen▫ n.d.94,0 %13 mars 2025✅ Mesuré
34KlingKuaishou🔒 Propriétaire93,4 %1 août 2024✅ Mesuré
35VideoCrafter-0.9▫ n.d.93,0 %23 novembre 2023✅ Mesuré
36LTX-VideoLightricks▫ n.d.92,8 %2 décembre 2024✅ Mesuré
37AnimateDiff-V2▫ n.d.92,6 %3 juin 2024✅ Mesuré
38MiniMax-Video-01MiniMax▫ n.d.92,4 %1 octobre 2024✅ Mesuré
39ModelScope▫ n.d.92,4 %23 novembre 2023✅ Mesuré
40VideoCrafter-1.0▫ n.d.91,6 %19 janvier 2024✅ Mesuré
41OpenSora V1.2HPC-AI Tech▫ n.d.91,2 %2 septembre 2024✅ Mesuré
42AnimateLCM▫ n.d.91,0 %28 juin 2024✅ Mesuré
43Jimeng▫ n.d.90,1 %15 novembre 2024✅ Mesuré
44Latte-1▫ n.d.90,0 %5 juin 2024✅ Mesuré
45Gen-2Runway🔒 Propriétaire89,2 %20 mars 2023✅ Mesuré
46MAGI-T2V-24B-distill▫ n.d.88,2 %6 août 2025✅ Mesuré
47Pika BetaPika Labs🔒 Propriétaire88,0 %19 janvier 2024✅ Mesuré
48OpenSoraPlan V1.1HPC-AI Tech▫ n.d.86,8 %17 juillet 2024✅ Mesuré
49OpenSoraPlan V1.3HPC-AI Tech▫ n.d.86,8 %7 novembre 2024✅ Mesuré
50HiGen▫ n.d.86,2 %20 juin 2024✅ Mesuré
51Pika-1.0Pika Labs🔒 Propriétaire86,2 %29 juillet 2024✅ Mesuré
52InstructVideo▫ n.d.85,2 %9 juillet 2024✅ Mesuré
53Open-SoraHPC-AI Tech▫ n.d.85,0 %20 avril 2024✅ Mesuré
54MAGI-T2V-4.5B-distill▫ n.d.84,2 %10 juin 2025✅ Mesuré
55OpenSora V1.1HPC-AI Tech▫ n.d.84,2 %17 juillet 2024✅ Mesuré
56Wan2.2-T2V-A14BQwen▫ n.d.83,4 %18 février 2026✅ Mesuré
57AnimateDiff-V1▫ n.d.82,2 %2 août 2024✅ Mesuré
58TF-T2V▫ n.d.79,0 %20 juin 2024✅ Mesuré
59CogVideoZhipu AI▫ n.d.78,2 %23 novembre 2023✅ Mesuré
60LTX-2Lightricks▫ n.d.76,2 %4 février 2026✅ Mesuré
61Mira▫ n.d.63,8 %17 juillet 2024✅ Mesuré
62OpenSoraPlan V1.2HPC-AI Tech▫ n.d.58,2 %29 octobre 2024✅ Mesuré

Classement établi sur 62 modèles évalués, dont 6 de grands éditeurs. Score médian de l'ensemble : 94,2 %.

Notre analyse

Un score élevé indique que les actions humaines visibles dans les vidéos sont fréquemment reconnues comme conformes aux actions formulées dans les prompts. L’évaluation repose sur une mesure automatique normalisée, plutôt que sur une simple déclaration des créateurs de modèles, et les scores sont au moins en partie mesurés par un tiers, ce qui renforce leur valeur comparative. Le classement montre toutefois une forte concentration dans le haut de l’échelle: avec une médiane de 94 % parmi 62 modèles et CausVid à 100 %, la dimension apparaît proche de la saturation. Les écarts élevés deviennent donc moins discriminants, notamment au sommet. La portée reste ciblée sur la reconnaissance ou la classification d’actions humaines, sans représenter à elle seule l’ensemble des qualités d’une vidéo générée. Enfin, l’accès public au benchmark peut favoriser l’exposition préalable aux prompts ou au protocole, un facteur de contamination potentielle à garder en compte lors de l’interprétation des résultats.


Sources des scores : vbench.