O Claude Opus 5.5 foi lançado, liderando o SimpleBench com uma pontuação de 88,4% e gerando grande atenção da comunidade por sua capacidade de produzir vídeos explicativos de alta qualidade.

  • Nas avaliações de visão, é classificado como o melhor modelo de visão da Anthropic até hoje, superando o Fable 5 e o GPT-6 Sol enquanto custa cerca de 60% menos que o Fable 5.1.
  • O desempenho de raciocínio no Terminal-Bench-Science atinge 62% com esforço xhigh, embora caia para 59% no esforço máximo devido aos orçamentos mínimos impostos.
  • Lidera o ranking do Terminal-Bench-Science ao lado do GPT-6 Astra, superando o Fable 5.1 em aproximadamente 20 pontos.
  • O plano Claude Code de $200 é relatado como superior ao Codex, enquanto o Astra permanece como o modelo preferido para tarefas de revisão e auditoria.

O lançamento estabelece o Opus 5.5 como um modelo de fronteira de alto nível com fortes capacidades de visão e eficiência de custo em comparação aos concorrentes.