Claude Opus 5
Claude Opus 5 est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 24 juillet 2026. Positionné sur le haut de gamme, il associe une fenêtre de contexte d’un million de tokens à une tarification premium.
Claude Opus 5 est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 24 juillet 2026. Positionné sur le haut de gamme, il associe une fenêtre de contexte d’un million de tokens à une tarification premium.
Son profil se distingue par des résultats de premier plan en mathématiques difficiles et en sciences. À sa sortie, il figurait dans le haut du panier de sa génération sur GPQA diamond et dans plusieurs top 10 d’Epoch. Cette spécialisation le place parmi les modèles conçus pour les tâches de raisonnement exigeantes et les très longs contextes.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | Anthropic |
| Poids | 🔒 Propriétaire |
| Date de sortie | 24 juillet 2026 |
| Multimodal | oui |
| Fenêtre de contexte | 1 000 000 tokens (≈ 1,0 M) |
| Modalités (entrée → sortie) | text,image → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Epoch: OTIS Mock AIME 2024-2025 | 98,9 % | 6ᵉ / 119 | epoch | ✅ Mesuré |
| Epoch: GPQA diamond | 93,9 % | 5ᵉ / 140 | epoch | ✅ Mesuré |
| Epoch: FrontierMath-Tiers-1-3-v2-Private | 85,6 % | 5ᵉ / 39 | epoch | ✅ Mesuré |
| Epoch: FrontierMath-Tier-4-v2-Private | 73,2 % | 5ᵉ / 40 | epoch | ✅ Mesuré |
| Epoch: SimpleQA Verified | 56,7 % | 14ᵉ / 60 | epoch | ✅ Mesuré |
| Epoch: Chess Puzzles | 42,0 % | 10ᵉ / 52 | epoch | ✅ Mesuré |
| BrowseComp | 90,8 % | 2ᵉ / 58 | llm-stats | Auto-déclaré |
| OSWorld 2.0 | 70,6 % | 1ᵉ / 4 | llm-stats | Auto-déclaré |
| DeepSWE 1.1 | 68,8 % | 5ᵉ / 18 | llm-stats | Auto-déclaré |
| Humanity's Last Exam | 64,7 % | 1ᵉ / 90 | llm-stats | Auto-déclaré |
| GDPval-AA | 62,0 % | 1ᵉ / 42 | llm-stats | Auto-déclaré |
| HealthBench Professional | 59,8 % | 3ᵉ / 9 | llm-stats | Auto-déclaré |
| FrontierCode | 53,4 % | 1ᵉ / 3 | llm-stats | Auto-déclaré |
| FrontierCode 1.1 | 53,4 % | 2ᵉ / 15 | llm-stats | n.d. |
| ARC-AGI-3 | 30,2 % | 1ᵉ / 4 | llm-stats | Auto-déclaré |
| AutomationBench | 26,0 % | 2ᵉ / 7 | llm-stats | Auto-déclaré |
| Legal Agent Benchmark | 11,7 % | 2ᵉ / 13 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Epoch: OTIS Mock AIME 2024-2025
Epoch: GPQA diamond
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| anthropic | 5 $ | 25 $ | n.d. |
| Claude Platform on AWS | 5 $ | 25 $ | 0,5 $ |
| Anthropic | 10 $ | 50 $ | 1 $ |
Prix en dollars US par million de tokens.
Sa tarification se situe 140 % au-dessus de la moyenne des LLM similaires, et 1,1 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Entraînement & empreinte
| Indicateur | Valeur |
|---|---|
| Pays | United States of America |
Notre analyse
Forces. À sa sortie, Claude Opus 5 se classait dans le top 6 % des 87 LLM de sa génération sur GPQA diamond. Il atteint 94 % sur ce benchmark consacré aux questions scientifiques de niveau doctorat. Il figure aussi dans le top 10 sur OTIS Mock AIME 2024-2025 et sur les deux niveaux de FrontierMath, consacrés aux mathématiques de recherche très difficiles. Ces résultats montrent une forte maîtrise du raisonnement mathématique et scientifique. Sa fenêtre d’un million de tokens constitue également un atout pour traiter de très grands volumes de contexte.
Limites et points d’attention. Le résultat de 57 % sur SimpleQA Verified place Claude Opus 5 au 14e rang sur 60, en retrait de ses classements en mathématiques et en sciences. Les questions factuelles vérifiables constituent donc son principal point faible dans ces évaluations. Son score de 42 % aux Chess Puzzles reste modeste, malgré une place dans le top 10. Le modèle est propriétaire et son tarif dépasse de 140 % la moyenne des LLM similaires. Il coûte toutefois environ 1,1 fois moins cher que les modèles frontière. Claude Opus 5 cible surtout les usages scientifiques, mathématiques et documentaires qui justifient un grand contexte et un budget premium.
Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Epoch AI (epoch.ai), CC-BY-4.0.