Anthropic a publié Claude Opus 5, remplaçant Claude Opus 4.8 comme modèle phare de la gamme Opus tout en maintenant un prix inchangé de 5 $ par million de tokens d'entrée et de 25 $ par million de tokens de sortie.
- La réflexion est désormais activée par défaut, contrôlée par le paramètre effort, avec une rupture de compatibilité qui renvoie une erreur 400 si la réflexion est désactivée aux niveaux d'effort xhigh ou max.
- L'ID du modèle est claude-opus-5, disposant d'une fenêtre de contexte de 1M de tokens et d'une sortie maximale de 128k tokens sur l'API Messages synchrone.
- Sur FrontierBench v0.1, Opus 5 a obtenu 43,3 % à effort maximal, surpassant Fable 5 (33,7 %) et GPT-5.6 Sol (37,5 %).
- Les performances agentiques ont connu des sauts significatifs, atteignant 70,57 % sur OSWorld 2.0 et 26,0 % sur Zapier AutomationBench.
- Opus 5 a obtenu une note vérifiée de 30,16 % sur ARC-AGI-3, environ quatre fois le meilleur score précédent, et a marqué 56,3 % à l'examen final de l'humanité sans outils.
- Les garde-fous cybernétiques ont été ajustés pour permettre la détection des vulnérabilités dans le code source tout en bloquant leur exploitation, avec une baisse significative des taux de réussite des injections de prompts sur les benchmarks Gray Swan.
Anthropic positionne Opus 5 comme approchant l'intelligence de Claude Fable 5 à moitié prix, ce qui en fait le modèle par défaut sur Claude Max et la meilleure option sur Claude Pro.