A OpenAI lançou três novos modelos — GPT-4.1, GPT-4.1 mini e GPT-4.1 nano — em sua API, com melhorias em codificação, seguimento de instruções e capacidades de contexto longo em comparação ao GPT-4o.
- O GPT-4.1 obtém 54,6% no SWE-bench Verified, uma melhoria absoluta de 21,4% sobre o GPT-4o, e estabelece um novo estado da arte no Video-MME para compreensão multimodal de contexto longo.
- O GPT-4.1 mini reduz a latência em quase metade e o custo em 83%, enquanto iguala ou supera o GPT-4o em avaliações de inteligência.
- O GPT-4.1 nano é o modelo mais rápido e barato, obtendo 80,1% no MMLU e suportando uma janela de contexto de 1 milhão de tokens.
- Todos os modelos suportam até 1 milhão de tokens de contexto e possuem um corte de conhecimento em junho de 2024.
Essas melhorias tornam a família GPT-4.1 mais eficaz para construir agentes e lidar com tarefas complexas como engenharia de software e análise de documentos.