GPT-5.2 Pro
Publié le 11 décembre 2025 par OpenAI, GPT-5.2 Pro est un LLM propriétaire haut de gamme, dont les poids ne sont pas ouverts. Son positionnement repose sur une fenêtre de contexte de 400 000 tokens et sur des résultats élevés dans des évaluations particulièrement exigeantes.
Publié le 11 décembre 2025 par OpenAI, GPT-5.2 Pro est un LLM propriétaire haut de gamme, dont les poids ne sont pas ouverts. Son positionnement repose sur une fenêtre de contexte de 400 000 tokens et sur des résultats élevés dans des évaluations particulièrement exigeantes.
À sa sortie, ce modèle américain figurait dans le top 1% des LLM de sa génération sur GPQA. Cette performance le plaçait parmi les systèmes les plus compétitifs de son époque, avec une orientation premium également très nette dans sa tarification.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | OpenAI |
| Poids | 🔒 Propriétaire |
| Date de sortie | 11 décembre 2025 |
| Multimodal | oui |
| Fenêtre de contexte | 400 000 tokens |
| Modalités (entrée → sortie) | text,image → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| AIME 2025 | 100,0 % | 1ᵉ / 108 | llm-stats | Auto-déclaré |
| HMMT 2025 | 100,0 % | 1ᵉ / 33 | llm-stats | Auto-déclaré |
| GPQA | 93,2 % | 8ᵉ / 219 | llm-stats | Auto-déclaré |
| ARC-AGI | 90,5 % | 3ᵉ / 7 | llm-stats | Auto-déclaré |
| BrowseComp | 77,9 % | 21ᵉ / 57 | llm-stats | Auto-déclaré |
| ARC-AGI v2 | 54,2 % | 7ᵉ / 16 | llm-stats | Auto-déclaré |
| Humanity's Last Exam | 36,6 % | 36ᵉ / 89 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| OpenAI | 21 $ | 168 $ | n.d. |
Prix en dollars US par million de tokens.
Sa tarification se situe 907 % au-dessus de la moyenne des LLM similaires, et 3,8 fois plus cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Entraînement & empreinte
| Indicateur | Valeur |
|---|---|
| Pays | United States of America |
Notre analyse
Forces. GPT-5.2 Pro se distingue sur FrontierMath (mathématiques de recherche, très difficiles). Il atteint le top 10 sur l’évaluation couvrant les trois premiers niveaux et sur une version privée de Tier 4, ce qui traduit une forte compétitivité sur des problèmes mathématiques avancés. Sur l’autre évaluation privée de Tier 4, il reste proche du top 10. Son classement dans le top 1% de sa génération sur GPQA confirme qu’à sa sortie, il appartenait au haut du panier. Sa fenêtre de contexte de 400 000 tokens constitue aussi un trait central pour les tâches portant sur de très grands volumes de texte.
Limites et points d'attention. Les résultats sur FrontierMath Tier 4 restent variables selon la version du benchmark, avec une position hors du top 10 dans l’une des évaluations. Le principal frein est toutefois économique : la tarification est 954% supérieure à la moyenne des LLM similaires et environ 3,8 fois plus élevée que celle des modèles frontière. Avec 21 $ par million de tokens en entrée et 168 $ en sortie, le coût peut rapidement devenir déterminant. GPT-5.2 Pro cible donc surtout les usages à forte valeur nécessitant un long contexte ou des performances élevées en mathématiques difficiles.
Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Epoch AI (epoch.ai), CC-BY-4.0.