Claude Opus 5.5 est disponible, menant SimpleBench avec un score de 88,4 % et générant une attention significative de la communauté grâce à sa capacité à produire des vidéos explicatives de haute qualité.
- Sur les évaluations visuelles, il est classé comme le meilleur modèle visuel d'Anthropic à ce jour, surpassant Fable 5 et GPT-6 Sol tout en coûtant environ 60 % de moins que Fable 5.1.
- Les performances de raisonnement sur Terminal-Bench-Science atteignent un pic de 62 % avec un effort élevé, bien qu'elles chutent à 59 % à l'effort maximal en raison des budgets minimum imposés.
- Il mène le classement Terminal-Bench-Science aux côtés de GPT-6 Astra, surpassant Fable 5.1 d'environ 20 points.
- L'offre Claude Code à 200 $ est rapportée comme battant Codex, tandis qu'Astra reste le modèle préféré pour les tâches de révision et d'audit.
Cette sortie établit Opus 5.5 comme un modèle de pointe de premier ordre avec de solides capacités visuelles et une efficacité économique par rapport aux concurrents.