ERNIE 4.5

ERNIE 4.5 est un LLM propriétaire de Baidu, lancé le 25 juin 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement rapide des catalogues tend à reléguer les modèles précédents.

ERNIE 4.5 est un LLM propriétaire de Baidu, lancé le 25 juin 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement rapide des catalogues tend à reléguer les modèles précédents.

Le modèle réunit 21 milliards de paramètres et une fenêtre de contexte de 128 000 tokens. À sa sortie, son résultat sur GPQA le plaçait dans le top 23 % des 110 LLM de sa génération, soit dans le quart supérieur sans atteindre la tête du classement. Ses poids ne sont pas ouverts.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurBaidu
Poids🔒 Propriétaire
Date de sortie25 juin 2025
Multimodalnon
Paramètres21 milliards
Fenêtre de contexte128 000 tokens
Modalités (entrée → sortie)text → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
GPQA74,0 %102ᵉ / 219llm-statsAuto-déclaré
ARC-E60,7 %8ᵉ / 8llm-statsAuto-déclaré
PIQA55,2 %11ᵉ / 11llm-statsAuto-déclaré
Winogrande51,3 %22ᵉ / 22llm-statsAuto-déclaré
CLUEWSC48,6 %3ᵉ / 3llm-statsAuto-déclaré
MMLU-Redux43,2 %48ᵉ / 48llm-statsAuto-déclaré
MMLU41,9 %98ᵉ / 98llm-statsAuto-déclaré
C-Eval40,7 %18ᵉ / 18llm-statsAuto-déclaré
ARC-C40,6 %34ᵉ / 34llm-statsAuto-déclaré
MBPP+40,2 %4ᵉ / 4llm-statsAuto-déclaré
CMMLU39,8 %6ᵉ / 6llm-statsAuto-déclaré
HellaSwag33,0 %27ᵉ / 27llm-statsAuto-déclaré
BBH30,4 %12ᵉ / 12llm-statsAuto-déclaré
DROP28,6 %29ᵉ / 29llm-statsAuto-déclaré
AGIEval28,5 %10ᵉ / 10llm-statsAuto-déclaré
GSM8k25,2 %47ᵉ / 47llm-statsAuto-déclaré
HumanEval+25,0 %10ᵉ / 10llm-statsAuto-déclaré
MMLU-Pro16,0 %124ᵉ / 125llm-statsAuto-déclaré
MATH12,4 %70ᵉ / 70llm-statsAuto-déclaré
SimpleQA1,8 %45ᵉ / 45llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. À son lancement, ERNIE 4.5 occupait une position solide sur GPQA : il devançait plus des trois quarts des LLM sortis au cours des quelque 18 mois précédents. Ce classement le situait dans le haut du panier de sa génération, même s’il ne faisait pas partie des modèles dominants. Sa fenêtre de contexte de 128 000 tokens constitue son autre caractéristique notable, associée à une architecture de 21 milliards de paramètres.

Limites et points d'attention. Son ancienneté d’environ un an est très importante dans un secteur où les générations se succèdent rapidement. Ses performances doivent donc être appréciées par rapport aux modèles disponibles lors de sa sortie, et sont probablement largement dépassées par les modèles plus récents. Les modèles de cette période sont également souvent retirés du catalogue de leur éditeur. La licence propriétaire interdit l’accès ouvert aux poids, ce qui distingue ERNIE 4.5 des modèles distribués avec leurs paramètres. Enfin, son positionnement repose sur une seule source de données concordante.


Sources des données : LLM-Stats (llm-stats.com).