Qwen1.5-72B
Qwen1.5-72B est un LLM de 72 milliards de paramètres publié par Qwen le 4 février 2024. Originaire de Chine, il appartient désormais à une génération ancienne, près de deux ans représentant une période très longue à l’échelle de l’IA. Ses performances sont probablement dépassées et le…
Qwen1.5-72B est un LLM de 72 milliards de paramètres publié par Qwen le 4 février 2024. Originaire de Chine, il appartient désormais à une génération ancienne, près de deux ans représentant une période très longue à l’échelle de l’IA. Ses performances sont probablement dépassées et le modèle est aujourd’hui susceptible d’avoir été retiré du catalogue de son éditeur.
Son entraînement reste marquant par son ampleur estimée à 1,3 × 10²⁴ FLOP, soit environ 361 000 heures-GPU H100. Cette charge correspond à près de 170 GPU H100 fonctionnant sans interruption pendant trois mois.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | Qwen |
| Poids | ▫ n.d. |
| Date de sortie | 4 février 2024 |
| Paramètres | 72 milliards |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Epoch: GPQA diamond | 28,8 % | 76ᵉ / 85 | epoch | ✅ Mesuré |
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Epoch: GPQA diamond
Entraînement & empreinte
| Indicateur | Valeur |
|---|---|
| Compute d'entraînement | 1,3 × 10²⁴ FLOP |
| Taille du jeu d'entraînement | 3,0 × 10¹² |
| Jeu de données | Unspecified unreleased |
| Pays | China |
Notre analyse
Forces. À sa sortie, Qwen1.5-72B se classait dans le top 71% des 14 LLM de sa génération, définie ici comme les modèles publiés durant les quelque 18 mois précédents. Ce positionnement ne le plaçait pas dans le groupe de tête, mais témoignait d’un niveau comparable à une partie des grands modèles contemporains. Ses 72 milliards de paramètres et son entraînement équivalent à environ 361 000 heures-GPU H100 illustrent surtout l’échelle des moyens mobilisés par Qwen début 2024.
Limites et points d'attention. Qwen1.5-72B obtient un résultat faible sur GPQA diamond, qui évalue des questions scientifiques de niveau doctorat. Son rang, 126e sur 137 modèles, le situe aujourd’hui près du bas du classement disponible. Cette performance contraste avec la puissance de calcul consacrée à son entraînement, estimée à 1,3 × 10²⁴ FLOP, soit l’équivalent d’environ 170 GPU H100 actifs pendant trois mois. Près de deux ans après sa sortie, ses résultats sont largement dépassés à l’échelle rapide de l’IA, et ce type d’ancienne génération est souvent retiré du catalogue de l’éditeur. Les données utilisées reposent sur deux sources concordantes.
Sources des données : LLM-Stats (llm-stats.com) · Epoch AI (epoch.ai), CC-BY-4.0.