GPT-5.5 Instant
GPT-5.5 Instant est un LLM propriétaire d’OpenAI, lancé le 5 mai 2026 avec des connaissances arrêtées au 31 août 2025. Son principal trait distinctif est une fenêtre de contexte de 1 050 000 tokens, adaptée au traitement de volumes de texte particulièrement importants.
GPT-5.5 Instant est un LLM propriétaire d’OpenAI, lancé le 5 mai 2026 avec des connaissances arrêtées au 31 août 2025. Son principal trait distinctif est une fenêtre de contexte de 1 050 000 tokens, adaptée au traitement de volumes de texte particulièrement importants.
Le modèle occupe un positionnement premium, avec un coût nettement supérieur à la moyenne des LLM similaires, tout en restant légèrement moins cher que les modèles frontière. Ses résultats dessinent un profil contrasté, solide en texte et en vision, mais moins convaincant sur les documents, le code et les tâches agentiques.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | OpenAI |
| Poids | 🔒 Propriétaire |
| Date de sortie | 5 mai 2026 |
| Connaissances jusqu'à | 2025-08-31 |
| Multimodal | oui |
| Fenêtre de contexte | 400 000 tokens |
| Modalités (entrée → sortie) | text,image → text |
Indices de synthèse
| Indice | Valeur | Rang (LLM) |
|---|---|---|
| Intelligence Index | 33.5 | 46ᵉ / 137 |
| Code Index | 39.4 | 47ᵉ / 74 |
| Agentic Index | 11.0 | 50ᵉ / 68 |
Indices Artificial Analysis. Le rang situe le modèle parmi tous les LLM du catalogue disposant de l'indice.
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| HealthBench Consensus | 94,7 % | 4ᵉ / 4 | llm-stats | Auto-déclaré |
| OmniDocBench 1.5 | 87,5 % | 10ᵉ / 13 | llm-stats | Auto-déclaré |
| GPQA | 85,6 % | 45ᵉ / 219 | llm-stats | Auto-déclaré |
| CharXiv-R | 81,6 % | 14ᵉ / 45 | llm-stats | Auto-déclaré |
| AIME 2025 | 81,2 % | 63ᵉ / 108 | llm-stats | Auto-déclaré |
| MMMU-Pro | 76,0 % | 28ᵉ / 64 | llm-stats | Auto-déclaré |
| HealthBench | 51,4 % | 7ᵉ / 8 | llm-stats | Auto-déclaré |
| HealthBench Professional | 38,4 % | 7ᵉ / 8 | llm-stats | Auto-déclaré |
| HealthBench Hard | 22,9 % | 7ᵉ / 9 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Intelligence Index
Code Index
Classements Arena (Elo)
Arena Text · 200 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Fable 5 | 1507 |
| 2ᵉ | Claude Opus 4.6 | 1504 |
| 3ᵉ | Claude Opus 4.7 | 1503 |
| ⋯ | ⋯ | |
| 21ᵉ | Gemini 3.5 Flash | 1474 |
| 22ᵉ | Gemini 3 Flash | 1473 |
| 23ᵉ | GPT-5.5 Instant | 1473 |
| 24ᵉ | Grok-4.20 Beta | 1473 |
| 25ᵉ | Claude Opus 4.5 | 1473 |
Arena Document · 32 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Opus 4.6 | 1508 |
| 2ᵉ | Claude Fable 5 | 1507 |
| 3ᵉ | Claude Opus 4.6 | 1507 |
| ⋯ | ⋯ | |
| 28ᵉ | Gemini 3 Flash | 1413 |
| 29ᵉ | GPT-5.2 | 1405 |
| 30ᵉ | GPT-5.5 Instant | 1402 |
| 31ᵉ | GPT-5.1 | 1401 |
| 32ᵉ | GPT-5.2 | 1401 |
Arena Vision · 135 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Fable 5 | 1318 |
| 2ᵉ | Claude Opus 4.7 | 1304 |
| 3ᵉ | Claude Opus 4.6 | 1299 |
| ⋯ | ⋯ | |
| 17ᵉ | Claude Sonnet 4.6 | 1276 |
| 18ᵉ | Gemini 3.5 Flash | 1276 |
| 19ᵉ | GPT-5.5 Instant | 1276 |
| 20ᵉ | Gemini 3 Flash | 1271 |
| 21ᵉ | Kimi K2.6 | 1265 |
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| openai | 5 $ | 30 $ | n.d. |
Prix en dollars US par million de tokens.
Sa tarification se situe 140 % au-dessus de la moyenne des LLM similaires, et 1,1 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Notre analyse
Forces. GPT-5.5 Instant se place dans le haut du classement Arena text et obtient également un bon rang en Arena vision. À sa sortie, il figurait dans le top 22% des LLM de sa génération sur GPQA, ce qui le situait parmi les modèles compétitifs sur ce benchmark. Sa fenêtre de contexte d’environ 1,1 million de tokens constitue son avantage le plus concret pour les entrées très longues. Son tarif reste par ailleurs environ 1,1 fois inférieur à celui des modèles frontière.
Limites et points d’attention. Le classement Arena document est particulièrement faible, avec une position proche du bas du tableau. L’Intelligence Index se situe dans le tiers médian, tandis que le Code Index et surtout l’Agentic Index placent le modèle dans la partie basse de leurs classements respectifs. Le prix demeure élevé : la tarification est 151% au-dessus de la moyenne des LLM similaires, avec un écart marqué entre les tokens d’entrée et de sortie. Les poids ne sont pas ouverts, conformément à sa licence propriétaire. GPT-5.5 Instant cible donc surtout les usages textuels ou visuels nécessitant un contexte très étendu, plutôt que le traitement documentaire, le code ou les scénarios agentiques.
Sources des données : LLM-Stats (llm-stats.com) · Artificial Analysis (artificialanalysis.ai) · Arena.ai (arena.ai).