Mochi-1

Mochi-1 est un modèle de génération vidéo publié par Genmo le 7 novembre 2024. Il se positionne comme un outil de création de séquences pour la production audiovisuelle, la publicité et le prototypage de concepts.

Mochi-1 est un modèle de génération vidéo publié par Genmo le 7 novembre 2024. Il se positionne comme un outil de création de séquences pour la production audiovisuelle, la publicité et le prototypage de concepts.

Avec près de deux ans d’ancienneté, Mochi-1 appartient déjà à une génération ancienne à l’échelle de l’IA. Il se compare surtout aux modèles de sa période et paraît probablement dépassé par les systèmes plus récents.

Caractéristiques

CaractéristiqueValeur
TypeModèle de génération de vidéos
ÉditeurGenmo
Poids▫ n.d.
Date de sortie7 novembre 2024

Performances (benchmarks)

BenchmarkScoreRangSourceFiabilité
VBench: Stabilité temporelle99,4 %13ᵉ / 62vbench✅ Mesuré
VBench: Fluidité du mouvement99,0 %16ᵉ / 62vbench✅ Mesuré
VBench: Cohérence du sujet97,0 %24ᵉ / 62vbench✅ Mesuré
VBench: Actions humaines94,6 %30ᵉ / 62vbench✅ Mesuré
VBench: Qualité visuelle82,6 %35ᵉ / 62vbench✅ Mesuré
VBench: Total80,1 %39ᵉ / 62vbench✅ Mesuré
VBench: Respect du prompt70,1 %43ᵉ / 62vbench✅ Mesuré
VBench: Amplitude du mouvement61,9 %30ᵉ / 62vbench✅ Mesuré
VBench: Qualité d'image60,6 %53ᵉ / 62vbench✅ Mesuré
VBench: Qualité esthétique56,9 %51ᵉ / 62vbench✅ Mesuré

Scores objectifs mesurés par VBench (suite d'évaluation automatique de la génération vidéo), en pourcentage (plus haut = mieux). Le rang situe le modèle parmi les modèles vidéo évalués sur la même dimension.

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

VBench: Stabilité temporelle

Pika Beta100 %
IPOW100 %
MAGI-T2V-4.5B-distill100 %
Step-Video-T2V99 %
▶ Mochi-199 %

VBench: Fluidité du mouvement

Gen-2100 %
Pika Beta100 %
MiracleVision V599 %
▶ Mochi-199 %

Notre analyse

Forces. Mochi-1 se place dans le haut du classement VBench pour la stabilité temporelle et la fluidité du mouvement. Ces deux dimensions constituent ses principaux atouts pour produire des séquences régulières. Le benchmark atteint toutefois un plafond sur ces critères, ce qui réduit leur pouvoir discriminant. La cohérence du sujet reste correcte et se situe dans la première moitié du classement. Les actions humaines occupent une position médiane.

Limites et points d’attention. La qualité visuelle se situe dans la seconde moitié de VBench, tandis que le score total place Mochi-1 en retrait du classement. Le modèle combine donc une animation stable avec un rendu global moins abouti. Son ancienneté renforce ce décalage face aux générations récentes. Mochi-1 reste pertinent pour le prototypage vidéo, les maquettes publicitaires et les productions qui privilégient la continuité du mouvement.


Sources des données : LLM-Stats (llm-stats.com).