OpenAI: GPT Chat Latest

OpenAI: GPT Chat Latest est un LLM propriétaire lancé le 5 mai 2026. Positionné sur le segment premium, il se caractérise par une fenêtre de contexte de 400 000 tokens, adaptée au traitement de volumes de texte importants.

OpenAI: GPT Chat Latest est un LLM propriétaire lancé le 5 mai 2026. Positionné sur le segment premium, il se caractérise par une fenêtre de contexte de 400 000 tokens, adaptée au traitement de volumes de texte importants.

La tarification atteint 5 $ par million de tokens en entrée et 30 $ en sortie. Ce niveau dépasse de 140% la moyenne des LLM similaires, tout en restant environ 1.1 fois moins cher que les modèles frontière.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurOpenAI
Poids🔒 Propriétaire
Date de sortie5 mai 2026
Multimodaloui
Fenêtre de contexte400 000 tokens
Modalités (entrée → sortie)text,image,file → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Benchable : General Knowledge (Baseline)100,0 %1ᵉ / 161benchable✅ Mesuré
Benchable : Ethics (Baseline)99,0 %73ᵉ / 159benchable✅ Mesuré
Benchable : Email Classification (Baseline)99,0 %11ᵉ / 163benchable✅ Mesuré
Benchable : Hallucinations (Baseline)98,0 %47ᵉ / 146benchable✅ Mesuré
Benchable : Coding (Baseline)96,0 %7ᵉ / 162benchable✅ Mesuré
Benchable : Reasoning (Baseline)94,0 %42ᵉ / 155benchable✅ Mesuré
Benchable : Mathematics (Baseline)93,0 %44ᵉ / 140benchable✅ Mesuré
Benchable : Instruction Following (Baseline)88,0 %11ᵉ / 163benchable✅ Mesuré

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Benchable : General Knowledge (Baseline)

▶ GPT Chat Latest100 %

Benchable : Ethics (Baseline)

ui-tars-1.5-7b99 %
▶ GPT Chat Latest99 %
uncensored99 %

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
OpenAI5 $30 $0,5 $

Prix en dollars US par million de tokens.

Sa tarification se situe 140 % au-dessus de la moyenne des LLM similaires, et 1,1 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Coût & vitesse agentiques

IndicateurValeur
Coût moyen par benchmark — Benchable0,28 $
Latence moyenne par benchmark — Benchable2 min 28 s

Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.

Notre analyse

Forces. Coding constitue son meilleur résultat relatif dans Benchable : le modèle figure dans le top 10, à égalité avec cinq autres modèles. En General Knowledge, il obtient le score maximal, partagé avec 41 autres modèles. Email Classification le place près du top 10, même si 40 modèles partagent son rang. Ces résultats montrent un profil solide en code, en connaissances générales et en classement d'e-mails. La fenêtre de contexte de 400 000 tokens complète ce positionnement pour les traitements portant sur de longs contenus.

Limites et points d'attention. Les benchmarks Benchable sont plafonnés et départagent mal les modèles. Le score maximal en General Knowledge ne constitue donc pas un signe de domination. Ethics se situe en retrait du classement malgré un score brut élevé. Reasoning et Hallucinations restent également hors du haut du tableau. Le tarif premium représente l'autre limite majeure : il dépasse nettement celui des LLM similaires, même s'il reste inférieur à celui des modèles frontière. Ce profil cible surtout le code, la classification d'e-mails et les tâches à long contexte lorsque le budget accepte ce surcoût.


Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Benchable.ai (benchable.ai).