ERNIE 4.5
ERNIE 4.5 est un LLM propriétaire de Baidu, lancé le 25 juin 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement rapide des catalogues tend à reléguer les modèles précédents.
ERNIE 4.5 est un LLM propriétaire de Baidu, lancé le 25 juin 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement rapide des catalogues tend à reléguer les modèles précédents.
Le modèle réunit 21 milliards de paramètres et une fenêtre de contexte de 128 000 tokens. À sa sortie, son résultat sur GPQA le plaçait dans le top 23 % des 110 LLM de sa génération, soit dans le quart supérieur sans atteindre la tête du classement. Ses poids ne sont pas ouverts.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | Baidu |
| Poids | 🔒 Propriétaire |
| Date de sortie | 25 juin 2025 |
| Multimodal | non |
| Paramètres | 21 milliards |
| Fenêtre de contexte | 128 000 tokens |
| Modalités (entrée → sortie) | text → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| GPQA | 74,0 % | 102ᵉ / 219 | llm-stats | Auto-déclaré |
| ARC-E | 60,7 % | 8ᵉ / 8 | llm-stats | Auto-déclaré |
| PIQA | 55,2 % | 11ᵉ / 11 | llm-stats | Auto-déclaré |
| Winogrande | 51,3 % | 22ᵉ / 22 | llm-stats | Auto-déclaré |
| CLUEWSC | 48,6 % | 3ᵉ / 3 | llm-stats | Auto-déclaré |
| MMLU-Redux | 43,2 % | 48ᵉ / 48 | llm-stats | Auto-déclaré |
| MMLU | 41,9 % | 98ᵉ / 98 | llm-stats | Auto-déclaré |
| C-Eval | 40,7 % | 18ᵉ / 18 | llm-stats | Auto-déclaré |
| ARC-C | 40,6 % | 34ᵉ / 34 | llm-stats | Auto-déclaré |
| MBPP+ | 40,2 % | 4ᵉ / 4 | llm-stats | Auto-déclaré |
| CMMLU | 39,8 % | 6ᵉ / 6 | llm-stats | Auto-déclaré |
| HellaSwag | 33,0 % | 27ᵉ / 27 | llm-stats | Auto-déclaré |
| BBH | 30,4 % | 12ᵉ / 12 | llm-stats | Auto-déclaré |
| DROP | 28,6 % | 29ᵉ / 29 | llm-stats | Auto-déclaré |
| AGIEval | 28,5 % | 10ᵉ / 10 | llm-stats | Auto-déclaré |
| GSM8k | 25,2 % | 47ᵉ / 47 | llm-stats | Auto-déclaré |
| HumanEval+ | 25,0 % | 10ᵉ / 10 | llm-stats | Auto-déclaré |
| MMLU-Pro | 16,0 % | 124ᵉ / 125 | llm-stats | Auto-déclaré |
| MATH | 12,4 % | 70ᵉ / 70 | llm-stats | Auto-déclaré |
| SimpleQA | 1,8 % | 45ᵉ / 45 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Notre analyse
Forces. À son lancement, ERNIE 4.5 occupait une position solide sur GPQA : il devançait plus des trois quarts des LLM sortis au cours des quelque 18 mois précédents. Ce classement le situait dans le haut du panier de sa génération, même s’il ne faisait pas partie des modèles dominants. Sa fenêtre de contexte de 128 000 tokens constitue son autre caractéristique notable, associée à une architecture de 21 milliards de paramètres.
Limites et points d'attention. Son ancienneté d’environ un an est très importante dans un secteur où les générations se succèdent rapidement. Ses performances doivent donc être appréciées par rapport aux modèles disponibles lors de sa sortie, et sont probablement largement dépassées par les modèles plus récents. Les modèles de cette période sont également souvent retirés du catalogue de leur éditeur. La licence propriétaire interdit l’accès ouvert aux poids, ce qui distingue ERNIE 4.5 des modèles distribués avec leurs paramètres. Enfin, son positionnement repose sur une seule source de données concordante.
Sources des données : LLM-Stats (llm-stats.com).