Anthropic ha lanzado Claude Opus 5, reemplazando a Claude Opus 4.8 como el modelo insignia de la gama Opus, manteniendo un precio inalterado de $5 por millón de tokens de entrada y $25 por millón de tokens de salida.
- El pensamiento está ahora habilitado por defecto, controlado por el parámetro effort, con un cambio disruptivo que devuelve un error 400 si el pensamiento se desactiva en los niveles de esfuerzo xhigh o max.
- El ID del modelo es claude-opus-5, con una ventana de contexto de 1M tokens y una salida máxima de 128k tokens en la API Messages síncrona.
- En FrontierBench v0.1, Opus 5 obtuvo un 43,3% en esfuerzo máximo, superando a Fable 5 (33,7%) y GPT-5.6 Sol (37,5%).
- El rendimiento agéntico experimentó saltos significativos, alcanzando el 70,57% en OSWorld 2.0 y el 26,0% en Zapier AutomationBench.
- Opus 5 logró un 30,16% verificado en ARC-AGI-3, aproximadamente cuatro veces la mejor puntuación anterior, y obtuvo un 56,3% en Humanity's Last Exam sin herramientas.
- Las salvaguardias cibernéticas se ajustaron para permitir la detección de vulnerabilidades en el código fuente mientras se bloquea la explotación, con tasas de éxito de inyección de prompts que disminuyeron significativamente en los benchmarks Gray Swan.
Anthropic posiciona a Opus 5 como acercándose a la inteligencia de Claude Fable 5 a la mitad del precio, convirtiéndolo en el modelo predeterminado en Claude Max y la opción más potente en Claude Pro.