Anthropic ha lanzado Claude Fable 5.1, una actualización del modelo que establece un nuevo estándar para tareas de programación, trabajo de conocimiento y resolución de problemas de larga duración. El lanzamiento destaca importantes ganancias de rendimiento en el nuevo benchmark Terminal-Bench-Science 0.1, donde Fable 5.1 logró una puntuación de 52.6%, en comparación con 24.7% para Fable 5, 29.0% para Opus 5 y 22.4% para GPT-5.6 Sol.
- Claude Fable 5.1 introduce cinco niveles de razonamiento: bajo, medio, alto, xhigh y max, sin opción para desactivar el razonamiento por completo.
- Las pruebas con un prompt de generación de SVG de pelícano mostraron que los niveles de esfuerzo bajo y medio omitieron completamente los rastros de razonamiento, mientras que los niveles superiores produjeron monólogos internos detallados.
- El nivel de razonamiento 'max' requirió 65,927 tokens de salida y costó $3.30 por la tarea, resultando en la salida visual más detallada entre los modelos probados.
- Animar el SVG generado utilizando el nivel de pensamiento 'high' costó $1.37 y produjo un video con ruedas giratorias, aunque la dirección era incorrecta.
La actualización permite a los usuarios comparar el rendimiento del modelo a través de diferentes niveles de esfuerzo de razonamiento, revelando cómo la inversión computacional incrementada impacta la calidad y el detalle de la salida.