A Anthropic lançou o Claude Fable 5.1, uma atualização do modelo que estabelece um novo padrão para tarefas de codificação, trabalho de conhecimento e resolução de problemas de longa duração. O lançamento destaca ganhos significativos de desempenho no novo benchmark Terminal-Bench-Science 0.1, onde o Fable 5.1 alcançou uma pontuação de 52,6%, em comparação com 24,7% para o Fable 5, 29,0% para o Opus 5 e 22,4% para o GPT-5.6 Sol.

  • O Claude Fable 5.1 introduz cinco níveis de raciocínio: baixo, médio, alto, xhigh e max, sem opção de desativar o raciocínio completamente.
  • Testes em um prompt de geração de SVG de pelicano mostraram que os níveis de esforço baixo e médio ignoraram completamente os rastros de raciocínio, enquanto os níveis mais altos produziram monólogos internos detalhados.
  • O nível de raciocínio 'max' exigiu 65.927 tokens de saída e custou US$ 3,30 pela tarefa, resultando na saída visual mais detalhada entre os modelos testados.
  • Animar o SVG gerado usando o nível de pensamento 'high' custou US$ 1,37 e produziu um vídeo com rodas giratórias, embora a direção estivesse incorreta.

A atualização permite que os usuários comparem o desempenho do modelo em diferentes níveis de esforço de raciocínio, revelando como o aumento do investimento computacional impacta a qualidade e o detalhe da saída.