OpenAI: GPT-5.4 Pro
Publié par OpenAI le 5 mars 2026, GPT-5.4 Pro est un LLM premium qui se distingue par ses résultats en sciences, en mathématiques de recherche et en résolution de problèmes d’échecs. À sa sortie, il figurait dans le top 1 % des LLM de sa génération sur GPQA diamond.
Publié par OpenAI le 5 mars 2026, GPT-5.4 Pro est un LLM premium qui se distingue par ses résultats en sciences, en mathématiques de recherche et en résolution de problèmes d’échecs. À sa sortie, il figurait dans le top 1 % des LLM de sa génération sur GPQA diamond.
Sa fenêtre de contexte atteint 1 050 000 tokens, soit environ 1,1 million. Ce positionnement s’accompagne d’un tarif très élevé : 30 $ par million de tokens en entrée et 180 $ en sortie, soit 1406 % au-dessus de la moyenne des LLM similaires.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | OpenAI |
| Poids | 🔒 Propriétaire |
| Date de sortie | 5 mars 2026 |
| Multimodal | oui |
| Fenêtre de contexte | 1 050 000 tokens (≈ 1,1 M) |
| Modalités (entrée → sortie) | text,image,file → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Epoch: GPQA diamond | 94,6 % | 1ᵉ / 85 | epoch | ✅ Mesuré |
| Epoch: FrontierMath-Tiers-1-3-v2-Private | 82,5 % | 3ᵉ / 17 | epoch | ✅ Mesuré |
| Epoch: Chess Puzzles | 58,6 % | 2ᵉ / 20 | epoch | ✅ Mesuré |
| Epoch: FrontierMath-Tier-4-v2-Private | 58,5 % | 5ᵉ / 18 | epoch | ✅ Mesuré |
| Epoch: FrontierMath-2025-02-28-Private | 50,0 % | 1ᵉ / 32 | epoch | ✅ Mesuré |
| Epoch: SimpleQA Verified | 47,8 % | 10ᵉ / 26 | epoch | ✅ Mesuré |
| Epoch: FrontierMath-Tier-4-2025-07-01-Private | 37,5 % | 2ᵉ / 25 | epoch | ✅ Mesuré |
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Epoch: GPQA diamond
Epoch: FrontierMath-Tiers-1-3-v2-Private
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| OpenAI | 30 $ | 180 $ | n.d. |
Prix en dollars US par million de tokens.
Sa tarification se situe 1339 % au-dessus de la moyenne des LLM similaires, et 5,5 fois plus cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Entraînement & empreinte
| Indicateur | Valeur |
|---|---|
| Pays | United States of America |
Notre analyse
Forces. GPT-5.4 Pro occupe la première place sur GPQA diamond, consacré aux questions scientifiques de niveau doctorat. Il se classe également dans le top 10 sur les trois évaluations FrontierMath fournies, qui portent sur des problèmes de mathématiques de recherche très difficiles. Ses performances restent aussi parmi les meilleures sur Chess Puzzles. Ces résultats concordants décrivent un modèle particulièrement solide sur les tâches scientifiques et formelles complexes. La fenêtre de 1 050 000 tokens constitue une autre caractéristique majeure, avec une capacité de contexte sensiblement supérieure au format de documents ordinaires.
Limites et points d'attention. Le résultat sur SimpleQA Verified, consacré aux questions factuelles vérifiables, se situe seulement dans le milieu du classement. Ce contraste indique que l’excellence sur les évaluations scientifiques et mathématiques ne se traduit pas par une domination équivalente en restitution factuelle simple. Le coût constitue l’autre limite centrale : GPT-5.4 Pro est environ 5,5 fois plus cher que les modèles frontière et très au-dessus de la moyenne des LLM similaires. Il cible donc surtout les usages où les performances en sciences, en mathématiques difficiles ou sur de très longs contextes justifient un budget premium.
Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Epoch AI (epoch.ai), CC-BY-4.0.