OpenAI ने GPT-6.1 Sol जारी किया है, जो GPT-6 Sol का अपग्रेड है और एजेंटिक कोडिंग व पेशेवर कार्य में GPT-6 Astra की बुद्धिमत्ता के लगभग बराबर है, जबकि इसका मानक इनपुट और आउटपुट टोकन मूल्य Astra का लगभग एक-पाँचवां है।
- DeepSWE v1.1 पर, यह लगभग एक-पाँचवें खर्च पर GPT-6 Astra के बराबर है, जिससे GPT-6 Sol 6.4 प्रतिशत बिंदुओं से आगे निकल जाता है।
- GDP.pdf पर, यह Opus 5.5 से उच्च स्कोर करता है और प्रत्येक कार्य के लिए खर्च की आधी से कम लागत पर फॉलबैक के साथ Astra के प्रदर्शन के करीब पहुँचता है।
- AutomationBench पर, यह मध्यम तर्क प्रयास पर Opus 5.5 से 2.2 प्रतिशत बिंदु ऊपर स्कोर करता है और लगभग एक-तिहाई खर्च पर काम करता है।
- OSWorld 2.0 पर, यह GPT-6 Sol को सात प्रतिशत बिंदुओं से बेहतर करता है और एक-सातवें खर्च पर Astra के प्रदर्शन के 2.1 प्रतिशत बिंदु दूर रहता है।
- Terminal-Bench Science 0.1 पर, यह अधिकतम तर्क प्रयास पर GPT-6 Sol के स्कोर को दोगुने से भी अधिक करता है और प्रत्येक कार्य के लिए खर्च की आधी से कम लागत पर काम करता है।
- यह कम तर्क प्रयास पर कठिन प्रॉम्प्ट्स पर तथ्यात्मक त्रुटियों को GPT-6 Sol की तुलना में लगभग 32% कम करता है।
यह मॉडल आज ChatGPT Work और Codex में Plus, Pro, Business, Enterprise, और Edu उपयोगकर्ताओं के लिए उपलब्ध है, और OpenAI API के माध्यम से gpt-6.1-sol के रूप में भी उपलब्ध है।