أطلقت OpenAI نموذج GPT-6.1 Sol، وهو ترقية لـ GPT-6 Sol تقترب من ذكاء GPT-6 Astra في البرمجة الوكيلية والأعمال المهنية، مع تكلفة تُعادل تقريباً خمس أسعار الرموز المميزة للإدخال والإخراج القياسية لـ Astra.
- على DeepSWE v1.1، يتفوق على GPT-6 Sol بنقطة مئوية قدرها 6.4 ويتساوى مع GPT-6 Astra بتكلفة تُعادل نحو خمس التكلفة.
- على GDP.pdf، يحقق نتائج أعلى من Opus 5.5 مع آليات احتياطية بتكلفة أقل من نصف التكلفة لكل مهمة، ويقترب من أداء Astra.
- على AutomationBench، يتفوق على Opus 5.5 بنقطة مئوية قدرها 2.2 عند جهد استدلال متوسط، بتكلفة تُعادل ثلث التكلفة تقريباً.
- على OSWorld 2.0، يتفوق على GPT-6 Sol بنقطة مئوية قدرها سبع نقاط، ويقترب من أداء Astra بنقطة مئوية قدرها 2.1 بتكلفة تُعادل سابع التكلفة.
- على Terminal-Bench Science 0.1، يضاعف أكثر من ضعف نتيجة GPT-6 Sol عند جهد الاستدلال الأقصى، بتكلفة أقل من نصف التكلفة لكل مهمة.
- يقلل الأخطاء الواقعية في المطالبات الصعبة بنسبة تقارب 32% مقارنة بـ GPT-6 Sol عند جهد استدلال منخفض.
النموذج متاح اليوم لمستخدمي Plus و Pro و Business و Enterprise و Edu عبر ChatGPT Work و Codex، وكذلك عبر OpenAI API كـ gpt-6.1-sol.