Claude Opus 5 значительно превосходит Claude Opus 4.8 во всех аспектах, с наибольшим прогрессом в агентном программировании, управлении компьютером и долгосрочной работе с знаниями. Он устанавливает новый рекорд на нескольких сторонних бенчмарках и сопоставим или превосходит Claude Fable 5 и Claude Mythos 5 во многих оценках.

  • Opus 5 позиционируется как модель, не уступающая или превосходящая Fable 5 в практических задачах, при этом будучи быстрее и вдвое дешевле.
  • Модель намеренно избегала обучения на киберзадачах, что означает отсутствие полной способности к сложным кибератакам, характерной для моделей класса Mythos.
  • На оценках по вирусологии Opus 5 выглядит незначительно лучше Mythos 5, поскольку эти задачи включают отдельные шаги, а не требуют масштабного рассуждения.
  • ArtificialAnalysis оценивает Opus 5 на новом уровне 61, а точечная оценка Anthropic ECI составляет 162.1, помещая её на трендовую линию Mythos.

Статья предполагает, что сохранение размера Opus и отказ от киберобучения даёт защитникам время для доступа к превосходным инструментам с классификаторами, которые срабатывают на 85% реже, чем у Fable.