Anthropic выпустила Claude Fable 5.1, обновление модели, которое устанавливает новый стандарт для задач программирования, работы с знаниями и долгосрочного решения проблем. В релизе подчеркиваются значительные улучшения производительности на новом бенчмарке Terminal-Bench-Science 0.1, где Fable 5.1 достигла результата 52,6%, по сравнению с 24,7% для Fable 5, 29,0% для Opus 5 и 22,4% для GPT-5.6 Sol.
- Claude Fable 5.1 вводит пять уровней рассуждения: low, medium, high, xhigh и max, при этом полностью отключить рассуждение невозможно.
- Тестирование на задаче генерации SVG с пеликаном показало, что уровни low и medium полностью пропускали трассировку рассуждений, в то время как более высокие уровни генерировали подробные внутренние монологи.
- Уровень рассуждения 'max' потребовал 65 927 выходных токенов и стоил $3.30 за задачу, что привело к самому детальному визуальному результату среди протестированных моделей.
- Анимация сгенерированного SVG с использованием уровня мышления 'high' стоила $1.37 и создала видео с вращающимися колесами, хотя направление вращения было неверным.
Обновление позволяет пользователям сравнивать производительность модели на разных уровнях усилий рассуждения, выявляя, как увеличение вычислительных затрат влияет на качество и детализацию вывода.