OpenAI выпустила три новые модели — GPT-4.1, GPT-4.1 mini и GPT-4.1 nano — в своём API, которые по сравнению с GPT-4o обладают улучшенными возможностями программирования, следования инструкциям и работы с длинным контекстом.

  • GPT-4.1 набирает 54,6% на SWE-bench Verified, что на 21,4 процентных пункта выше результата GPT-4o, и устанавливает новый рекорд на Video-MME для мультимодального понимания длинного контекста.
  • GPT-4.1 mini сокращает задержку почти вдвое и стоимость на 83%, сохраняя уровень или превосходя GPT-4o в тестах на интеллект.
  • GPT-4.1 nano — самая быстрая и дешёвая модель, набирающая 80,1% на MMLU и поддерживающая контекстное окно объёмом 1 миллион токенов.
  • Все модели поддерживают до 1 миллиона токенов контекста и имеют границу знаний по июнь 2024 года.

Эти улучшения делают семейство GPT-4.1 более эффективным для создания агентов и решения сложных задач, таких как разработка программного обеспечения и анализ документов.