A Anthropic lançou o Claude Opus 5, substituindo o Claude Opus 4.8 como o modelo principal da linha Opus, mantendo os preços inalterados de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída.
- O raciocínio agora está ativado por padrão, controlado pelo parâmetro effort, com uma mudança incompatível que retorna um erro 400 se o raciocínio for desativado nos níveis xhigh ou max.
- O ID do modelo é claude-opus-5, apresentando uma janela de contexto de 1M tokens e uma saída máxima de 128k tokens na API Messages síncrona.
- No FrontierBench v0.1, o Opus 5 obteve 43,3% no esforço máximo, superando o Fable 5 (33,7%) e o GPT-5.6 Sol (37,5%).
- O desempenho agêntico teve saltos significativos, atingindo 70,57% no OSWorld 2.0 e 26,0% no Zapier AutomationBench.
- O Opus 5 alcançou uma pontuação verificada de 30,16% no ARC-AGI-3, aproximadamente quatro vezes a melhor pontuação anterior, e obteve 56,3% no Humanity's Last Exam sem ferramentas.
- As salvaguardas cibernéticas foram ajustadas para permitir a identificação de vulnerabilidades em código-fonte enquanto bloqueiam a exploração, com taxas de sucesso de injeção de prompt caindo significativamente nos benchmarks Gray Swan.
A Anthropic posiciona o Opus 5 como se aproximando da inteligência do Claude Fable 5 pela metade do preço, tornando-o o modelo padrão no Claude Max e a opção mais forte no Claude Pro.