Компания OpenAI представила семейство моделей GPT-5.6, предназначенное для обеспечения производительности на уровне передовых решений при значительно более низких затратах за счёт оптимизации усилий на рассуждение и внедрения новых элементов управления API. Обновление позволяет стартапам создавать более быстрых и мощных агентов с использованием меньших моделей, таких как Luna и Terra, для задач с высокой нагрузкой, оставляя большие модели для сложных суждений.

  • GPT-5.6 Sol при рассуждении на уровне «низкий» превосходит GPT-5.5 при рассуждении на уровне «высокий» в тесте Agents’ Last Exam при постоянных условиях бенчмарка.
  • На бенчмарке BrowseComp модель GPT-5.6 Luna набрала 84,04% за $1,33 по сравнению с результатом GPT-5.5 в 84,36% за $33,27.
  • Новые примитивы Responses API включают сохранённое рассуждение, нативную компактификацию, оркестрацию мультиагентных систем и программный вызов инструментов.
  • Включение сохранённого рассуждения и компактификации в ARC-AGI-3 увеличило результат GPT-5.6 Sol с 13,3% до 38,3% при использовании примерно в 6 раз меньшего количества выходных токенов.
  • Время жизни кэша промптов (TTL) увеличено до минимум 30 минут с детерминированными точками сброса кэша для повышения частоты попаданий и снижения задержек.

Эти изменения меняют экономику создания агентов, позволяя получать сопоставимые или лучшие результаты при доле затрат благодаря использованию меньших моделей и эффективных архитектурных решений.