OpenAI: GPT-5.4 Pro

Publié par OpenAI le 5 mars 2026, GPT-5.4 Pro est un LLM premium qui se distingue par ses résultats en sciences, en mathématiques de recherche et en résolution de problèmes d’échecs. À sa sortie, il figurait dans le top 1 % des LLM de sa génération sur GPQA diamond.

Publié par OpenAI le 5 mars 2026, GPT-5.4 Pro est un LLM premium qui se distingue par ses résultats en sciences, en mathématiques de recherche et en résolution de problèmes d’échecs. À sa sortie, il figurait dans le top 1 % des LLM de sa génération sur GPQA diamond.

Sa fenêtre de contexte atteint 1 050 000 tokens, soit environ 1,1 million. Ce positionnement s’accompagne d’un tarif très élevé : 30 $ par million de tokens en entrée et 180 $ en sortie, soit 1406 % au-dessus de la moyenne des LLM similaires.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurOpenAI
Poids🔒 Propriétaire
Date de sortie5 mars 2026
Multimodaloui
Fenêtre de contexte1 050 000 tokens (≈ 1,1 M)
Modalités (entrée → sortie)text,image,file → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Epoch: GPQA diamond94,6 %1ᵉ / 85epoch✅ Mesuré
Epoch: FrontierMath-Tiers-1-3-v2-Private82,5 %3ᵉ / 17epoch✅ Mesuré
Epoch: Chess Puzzles58,6 %2ᵉ / 20epoch✅ Mesuré
Epoch: FrontierMath-Tier-4-v2-Private58,5 %5ᵉ / 18epoch✅ Mesuré
Epoch: FrontierMath-2025-02-28-Private50,0 %1ᵉ / 32epoch✅ Mesuré
Epoch: SimpleQA Verified47,8 %10ᵉ / 26epoch✅ Mesuré
Epoch: FrontierMath-Tier-4-2025-07-01-Private37,5 %2ᵉ / 25epoch✅ Mesuré

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Epoch: GPQA diamond

▶ GPT-5.4 Pro95 %

Epoch: FrontierMath-Tiers-1-3-v2-Private

▶ GPT-5.4 Pro82 %

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
OpenAI30 $180 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 1339 % au-dessus de la moyenne des LLM similaires, et 5,5 fois plus cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Entraînement & empreinte

IndicateurValeur
PaysUnited States of America

Notre analyse

Forces. GPT-5.4 Pro occupe la première place sur GPQA diamond, consacré aux questions scientifiques de niveau doctorat. Il se classe également dans le top 10 sur les trois évaluations FrontierMath fournies, qui portent sur des problèmes de mathématiques de recherche très difficiles. Ses performances restent aussi parmi les meilleures sur Chess Puzzles. Ces résultats concordants décrivent un modèle particulièrement solide sur les tâches scientifiques et formelles complexes. La fenêtre de 1 050 000 tokens constitue une autre caractéristique majeure, avec une capacité de contexte sensiblement supérieure au format de documents ordinaires.

Limites et points d'attention. Le résultat sur SimpleQA Verified, consacré aux questions factuelles vérifiables, se situe seulement dans le milieu du classement. Ce contraste indique que l’excellence sur les évaluations scientifiques et mathématiques ne se traduit pas par une domination équivalente en restitution factuelle simple. Le coût constitue l’autre limite centrale : GPT-5.4 Pro est environ 5,5 fois plus cher que les modèles frontière et très au-dessus de la moyenne des LLM similaires. Il cible donc surtout les usages où les performances en sciences, en mathématiques difficiles ou sur de très longs contextes justifient un budget premium.


Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Epoch AI (epoch.ai), CC-BY-4.0.