OpenAI: GPT Chat Latest
OpenAI: GPT Chat Latest est un LLM propriétaire lancé le 5 mai 2026. Positionné sur le segment premium, il se caractérise par une fenêtre de contexte de 400 000 tokens, adaptée au traitement de volumes de texte importants.
OpenAI: GPT Chat Latest est un LLM propriétaire lancé le 5 mai 2026. Positionné sur le segment premium, il se caractérise par une fenêtre de contexte de 400 000 tokens, adaptée au traitement de volumes de texte importants.
La tarification atteint 5 $ par million de tokens en entrée et 30 $ en sortie. Ce niveau dépasse de 140% la moyenne des LLM similaires, tout en restant environ 1.1 fois moins cher que les modèles frontière.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | OpenAI |
| Poids | 🔒 Propriétaire |
| Date de sortie | 5 mai 2026 |
| Multimodal | oui |
| Fenêtre de contexte | 400 000 tokens |
| Modalités (entrée → sortie) | text,image,file → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Benchable : General Knowledge (Baseline) | 100,0 % | 1ᵉ / 161 | benchable | ✅ Mesuré |
| Benchable : Ethics (Baseline) | 99,0 % | 73ᵉ / 159 | benchable | ✅ Mesuré |
| Benchable : Email Classification (Baseline) | 99,0 % | 11ᵉ / 163 | benchable | ✅ Mesuré |
| Benchable : Hallucinations (Baseline) | 98,0 % | 47ᵉ / 146 | benchable | ✅ Mesuré |
| Benchable : Coding (Baseline) | 96,0 % | 7ᵉ / 162 | benchable | ✅ Mesuré |
| Benchable : Reasoning (Baseline) | 94,0 % | 42ᵉ / 155 | benchable | ✅ Mesuré |
| Benchable : Mathematics (Baseline) | 93,0 % | 44ᵉ / 140 | benchable | ✅ Mesuré |
| Benchable : Instruction Following (Baseline) | 88,0 % | 11ᵉ / 163 | benchable | ✅ Mesuré |
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Benchable : General Knowledge (Baseline)
Benchable : Ethics (Baseline)
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| OpenAI | 5 $ | 30 $ | 0,5 $ |
Prix en dollars US par million de tokens.
Sa tarification se situe 140 % au-dessus de la moyenne des LLM similaires, et 1,1 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Coût & vitesse agentiques
| Indicateur | Valeur |
|---|---|
| Coût moyen par benchmark — Benchable | 0,28 $ |
| Latence moyenne par benchmark — Benchable | 2 min 28 s |
Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.
Notre analyse
Forces. Coding constitue son meilleur résultat relatif dans Benchable : le modèle figure dans le top 10, à égalité avec cinq autres modèles. En General Knowledge, il obtient le score maximal, partagé avec 41 autres modèles. Email Classification le place près du top 10, même si 40 modèles partagent son rang. Ces résultats montrent un profil solide en code, en connaissances générales et en classement d'e-mails. La fenêtre de contexte de 400 000 tokens complète ce positionnement pour les traitements portant sur de longs contenus.
Limites et points d'attention. Les benchmarks Benchable sont plafonnés et départagent mal les modèles. Le score maximal en General Knowledge ne constitue donc pas un signe de domination. Ethics se situe en retrait du classement malgré un score brut élevé. Reasoning et Hallucinations restent également hors du haut du tableau. Le tarif premium représente l'autre limite majeure : il dépasse nettement celui des LLM similaires, même s'il reste inférieur à celui des modèles frontière. Ce profil cible surtout le code, la classification d'e-mails et les tâches à long contexte lorsque le budget accepte ce surcoût.
Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com) · Benchable.ai (benchable.ai).