A Anthropic apresentou o Claude 3.5 Haiku e uma versão aprimorada do Claude 3.5 Sonnet, avançando capacidades em raciocínio, codificação e processamento visual. A adição mais significativa ao modelo Sonnet aprimorado é sua capacidade de interpretar capturas de tela da GUI e gerar chamadas de ferramentas para realizar tarefas autonomamente.

  • O Claude 3.5 Sonnet aprimorado alcança uma taxa média de sucesso recorde de 14,9% no benchmark OSWorld usando apenas entradas de captura de tela, subindo para 22% com etapas de interação aumentadas.
  • O novo modelo Claude 3.5 Haiku demonstra forte desempenho em raciocínio e seguimento de instruções, frequentemente comparável ao original Claude 3.5 Sonnet e Claude 3 Opus.
  • Ambos os modelos passaram por extensas avaliações de segurança, incluindo testes de intrusão multimodais para riscos de uso de computador, e testes conjuntos pré-implementação pelos Institutos de Segurança de IA dos EUA e do Reino Unido.
  • O limite de conhecimento para o Claude 3.5 Sonnet aprimorado é abril de 2024, enquanto o Claude 3.5 Haiku tem um limite de julho de 2024.

Essas atualizações fornecem aos usuários capacidades aprimoradas de automação por meio do uso de computador e conclusão de tarefas agênticas melhoradas, mantendo rigorosos padrões de segurança alinhados com a Política de Escalonamento Responsável da Anthropic.