Claude Opus 5

Claude Opus 5 est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 24 juillet 2026. Positionné sur le haut de gamme, il associe une fenêtre de contexte d’un million de tokens à une tarification premium.

Claude Opus 5 est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 24 juillet 2026. Positionné sur le haut de gamme, il associe une fenêtre de contexte d’un million de tokens à une tarification premium.

Son profil se distingue par des résultats de premier plan en mathématiques difficiles et en sciences. À sa sortie, il figurait dans le haut du panier de sa génération sur GPQA diamond et dans plusieurs top 10 d’Epoch. Cette spécialisation le place parmi les modèles conçus pour les tâches de raisonnement exigeantes et les très longs contextes.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurAnthropic
Poids🔒 Propriétaire
Date de sortie24 juillet 2026
Multimodaloui
Fenêtre de contexte1 000 000 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text,image → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Epoch: OTIS Mock AIME 2024-202598,9 %6ᵉ / 119epoch✅ Mesuré
Epoch: GPQA diamond93,9 %5ᵉ / 140epoch✅ Mesuré
Epoch: FrontierMath-Tiers-1-3-v2-Private85,6 %5ᵉ / 39epoch✅ Mesuré
Epoch: FrontierMath-Tier-4-v2-Private73,2 %5ᵉ / 40epoch✅ Mesuré
Epoch: SimpleQA Verified56,7 %14ᵉ / 60epoch✅ Mesuré
Epoch: Chess Puzzles42,0 %10ᵉ / 52epoch✅ Mesuré
BrowseComp90,8 %2ᵉ / 58llm-statsAuto-déclaré
OSWorld 2.070,6 %1ᵉ / 4llm-statsAuto-déclaré
DeepSWE 1.168,8 %5ᵉ / 18llm-statsAuto-déclaré
Humanity's Last Exam64,7 %1ᵉ / 90llm-statsAuto-déclaré
GDPval-AA62,0 %1ᵉ / 42llm-statsAuto-déclaré
HealthBench Professional59,8 %3ᵉ / 9llm-statsAuto-déclaré
FrontierCode53,4 %1ᵉ / 3llm-statsAuto-déclaré
FrontierCode 1.153,4 %2ᵉ / 15llm-statsn.d.
ARC-AGI-330,2 %1ᵉ / 4llm-statsAuto-déclaré
AutomationBench26,0 %2ᵉ / 7llm-statsAuto-déclaré
Legal Agent Benchmark11,7 %2ᵉ / 13llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Epoch: OTIS Mock AIME 2024-2025

▶ Claude Opus 599 %

Epoch: GPQA diamond

▶ Claude Opus 594 %

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
anthropic5 $25 $n.d.
Claude Platform on AWS5 $25 $0,5 $
Anthropic10 $50 $1 $

Prix en dollars US par million de tokens.

Sa tarification se situe 140 % au-dessus de la moyenne des LLM similaires, et 1,1 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Entraînement & empreinte

IndicateurValeur
PaysUnited States of America

Notre analyse

Forces. À sa sortie, Claude Opus 5 se classait dans le top 6 % des 87 LLM de sa génération sur GPQA diamond. Il atteint 94 % sur ce benchmark consacré aux questions scientifiques de niveau doctorat. Il figure aussi dans le top 10 sur OTIS Mock AIME 2024-2025 et sur les deux niveaux de FrontierMath, consacrés aux mathématiques de recherche très difficiles. Ces résultats montrent une forte maîtrise du raisonnement mathématique et scientifique. Sa fenêtre d’un million de tokens constitue également un atout pour traiter de très grands volumes de contexte.

Limites et points d’attention. Le résultat de 57 % sur SimpleQA Verified place Claude Opus 5 au 14e rang sur 60, en retrait de ses classements en mathématiques et en sciences. Les questions factuelles vérifiables constituent donc son principal point faible dans ces évaluations. Son score de 42 % aux Chess Puzzles reste modeste, malgré une place dans le top 10. Le modèle est propriétaire et son tarif dépasse de 140 % la moyenne des LLM similaires. Il coûte toutefois environ 1,1 fois moins cher que les modèles frontière. Claude Opus 5 cible surtout les usages scientifiques, mathématiques et documentaires qui justifient un grand contexte et un budget premium.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Epoch AI (epoch.ai), CC-BY-4.0.