OpenAI выпустила GPT-6.1 Sol, обновление модели GPT-6 Sol, которое почти сопоставимо с интеллектом GPT-6 Astra в задачах агентного программирования и профессиональной работы, при этом стоимость примерно в пять раз ниже стандартных цен Astra на входные и выходные токены.
- На DeepSWE v1.1 она сопоставима с GPT-6 Astra примерно по стоимости в одну пятую, превосходя GPT-6 Sol на 6,4 процентных пункта.
- На GDP.pdf она показывает результат выше, чем Opus 5.5, с механизмами резервного выполнения при стоимости менее половины за задачу и приближается к производительности Astra.
- На AutomationBench она опережает Opus 5.5 на 2,2 процентных пункта при среднем уровне рассуждений примерно по трети от стоимости.
- На OSWorld 2.0 она превосходит GPT-6 Sol на семь процентных пунктов и приближается к показателям Astra на расстоянии 2,1 процентного пункта при стоимости в одну седьмую.
- На Terminal-Bench Science 0.1 она более чем вдвое превышает результат GPT-6 Sol при максимальном уровне рассуждений при стоимости менее половины за задачу.
- Она снижает количество фактических ошибок на сложных запросах примерно на 32% по сравнению с GPT-6 Sol при низком уровне рассуждений.
Модель доступна сегодня пользователям Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex, а также через OpenAI API как gpt-6.1-sol.