GPT-5.5 Pro

GPT-5.5 Pro est un LLM propriétaire d’OpenAI, lancé le 23 avril 2026 et positionné sur le segment premium. Il se distingue par une fenêtre de contexte de 1 050 000 tokens, soit environ 1,1 million, et par des connaissances arrêtées au 1er décembre 2025.

GPT-5.5 Pro est un LLM propriétaire d’OpenAI, lancé le 23 avril 2026 et positionné sur le segment premium. Il se distingue par une fenêtre de contexte de 1 050 000 tokens, soit environ 1,1 million, et par des connaissances arrêtées au 1er décembre 2025.

À sa sortie, GPT-5.5 Pro figurait dans le top 5% des LLM de sa génération sur GPQA diamond. Ses résultats le placent également parmi les modèles les plus performants en mathématiques complexes, en sciences et en résolution de problèmes d’échecs. Son évaluation repose sur quatre sources de données concordantes.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurOpenAI
Poids🔒 Propriétaire
Date de sortie23 avril 2026
Connaissances jusqu'à2025-12-01
Multimodaloui
Fenêtre de contexte1 050 000 tokens (≈ 1,1 M)
Modalités (entrée → sortie)text,image → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
BrowseComp90,1 %3ᵉ / 57llm-statsAuto-déclaré
GDPval-MM82,3 %2ᵉ / 3llm-statsAuto-déclaré
Humanity's Last Exam57,2 %7ᵉ / 89llm-statsAuto-déclaré
FrontierMath39,6 %6ᵉ / 16llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
OpenAI30 $180 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 1339 % au-dessus de la moyenne des LLM similaires, et 5,5 fois plus cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût par exécution agentique — PinchBench (147 tâches)238,55 $
Durée d'exécution — PinchBench7 h 54 min
Indice valeur/coût — PinchBench0,24

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Entraînement & empreinte

IndicateurValeur
PaysUnited States of America

Notre analyse

Forces. GPT-5.5 Pro atteint la première place sur OTIS Mock AIME 2024-2025 (olympiades de mathématiques de niveau lycée) et sur Chess Puzzles. Il se classe aussi dans le top 10 sur GPQA diamond (questions scientifiques de niveau doctorat) ainsi que sur les deux évaluations FrontierMath, consacrées aux mathématiques de recherche très difficiles. Ces résultats indiquent un niveau particulièrement élevé en raisonnement mathématique, y compris sur les problèmes les plus exigeants. Sa fenêtre de contexte d’environ 1,1 million de tokens constitue une autre caractéristique majeure pour le traitement de volumes textuels étendus.

Limites et points d’attention. SimpleQA Verified constitue son résultat le moins convaincant parmi les évaluations fournies : le modèle reste dans le top 10, mais son score de 64% montre une marge d’erreur notable sur les questions factuelles vérifiables. Son tarif est surtout très élevé : il dépasse de 1406% la moyenne des LLM similaires et coûte environ 5,5 fois plus cher que les modèles frontière. Sa licence propriétaire exclut l’accès aux poids. GPT-5.5 Pro cible donc principalement les usages où le raisonnement mathématique, scientifique ou échiquéen et le très long contexte justifient un coût premium.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Epoch AI (epoch.ai), CC-BY-4.0 · PinchBench (pinchbench.com).