OpenAI: GPT-5.6 Luna Pro

OpenAI: GPT-5.6 Luna Pro est un LLM propriétaire lancé le 9 juillet 2026. Sa fenêtre de contexte de 1 050 000 tokens constitue son principal trait distinctif et autorise le traitement de très grands volumes de texte en entrée. Ses connaissances s'arrêtent au 16 février 2026.

OpenAI: GPT-5.6 Luna Pro est un LLM propriétaire lancé le 9 juillet 2026. Sa fenêtre de contexte de 1 050 000 tokens constitue son principal trait distinctif et autorise le traitement de très grands volumes de texte en entrée. Ses connaissances s'arrêtent au 16 février 2026.

Le modèle combine ce contexte étendu avec un positionnement très économique. Les tarifs commencent à 1 $ par million de tokens en entrée et 6 $ en sortie. Les évaluations Benchable montrent des scores bruts élevés, avec un résultat particulièrement solide en Coding, mais plusieurs épreuves sont plafonnées et départagent mal les modèles.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurOpenAI
Poids🔒 Propriétaire
Date de sortie9 juillet 2026
Connaissances jusqu'à2026-02-16
Multimodaloui
Fenêtre de contexte1 050 000 tokens (≈ 1,1 M)
Modalités (entrée → sortie)file,image,text → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Benchable : General Knowledge (Baseline)100,0 %1ᵉ / 161benchable✅ Mesuré
Benchable : Ethics (Baseline)99,0 %73ᵉ / 159benchable✅ Mesuré
Benchable : Hallucinations (Baseline)98,0 %47ᵉ / 146benchable✅ Mesuré
Benchable : Email Classification (Baseline)98,0 %55ᵉ / 163benchable✅ Mesuré
Benchable : Coding (Baseline)95,0 %17ᵉ / 162benchable✅ Mesuré
Benchable : Reasoning (Baseline)94,0 %42ᵉ / 155benchable✅ Mesuré
Benchable : Mathematics (Baseline)94,0 %30ᵉ / 140benchable✅ Mesuré
Benchable : Instruction Following (Baseline)86,9 %13ᵉ / 163benchable✅ Mesuré

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Benchable : General Knowledge (Baseline)

▶ GPT-5.6 Luna Pro100 %

Benchable : Ethics (Baseline)

ui-tars-1.5-7b99 %
▶ GPT-5.6 Luna Pro99 %
uncensored99 %

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
OpenAI1 $6 $0,1 $

Prix en dollars US par million de tokens.

Sa tarification se situe 52 % en dessous de la moyenne des LLM similaires, et 5,5 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,38 $
Latence moyenne par benchmark — Benchable4 min 27 s

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. La fenêtre de 1 050 000 tokens convient aux tâches nécessitant un contexte particulièrement volumineux. Coding constitue le résultat Benchable le plus distinctif du modèle, qui se situe dans le haut du classement malgré une large égalité. Les scores bruts sont également élevés en General Knowledge, Hallucinations, Email Classification et Reasoning. Le prix renforce ce positionnement : la tarification se situe 52% sous la moyenne des LLM similaires et environ 5,5 fois sous celle des modèles frontière.

Limites et points d'attention. Les benchmarks Benchable sont plafonnés et leurs nombreux ex æquo réduisent fortement leur pouvoir discriminant. Sur General Knowledge, le score maximal est partagé avec 41 autres modèles. Coding est partagé avec 13 autres, tandis que Reasoning, Hallucinations et Email Classification occupent des positions moins élevées malgré leurs scores bruts. Ethics se situe au milieu du classement et partage sa place avec 30 autres modèles. Les connaissances s'arrêtent près de cinq mois avant la sortie, ce qui limite la couverture des événements les plus récents. Ce modèle propriétaire cible surtout les traitements à très long contexte et les usages sensibles au coût.


Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Benchable.ai (benchable.ai).