OpenAI ने अपने GPT-5.6 मॉडलों के लिए महत्वपूर्ण मूल्य कटौती की घोषणा की है, जो सिस्टम दक्षता में सुधार और पुनरावर्ती स्व-अनुकूलन तकनीकों से प्रेरित है। कंपनी का दावा है कि GPT-5.4 स्तर की बुद्धिमत्ता की लागत चार महीनों में लगभग 13x कम हो गई है, जबकि GPT-5.6 Luna की कीमतें 80% और Terra की कीमतें 20% तक घटा दी गई हैं।
- OpenAI ने Triton और Gluon में उत्पादन कर्नेल को स्वतंत्र रूप से पुनः लिखने के लिए GPT-5.6 Sol का उपयोग किया, जिससे अंत-से-अंत सेवा लागत में 20% की कमी आई।
- सुधारी गई अनुमानित डिकोडिंग ने सैकड़ों स्वचालित प्रयोगों के माध्यम से टोकन-जनन दक्षता को 15% से अधिक बढ़ाया।
- एजेंटिक हार्नेस अनुकूलन, जिसमें विलंबित खोज और प्रॉम्प्ट कैशिंग शामिल हैं, ने Codex जैसे टूल्स के लिए दोहराई गई कंप्यूट लागत को कम किया।
- एक नया "Sol Fast" स्तर मानक मूल्य की दोगुनी कीमत पर 2.5x कम लेटेंसी प्रदान करता है, जबकि डाउनस्ट्रीम एजेंट वर्कफ़्लो में लगभग 10x कम लागत की उम्मीद है।
ये बदलाव OpenAI को नॉन-फाइन-ट्यूंड बुद्धिमत्ता के लिए अत्यंत लागत-प्रभावी बनाते हैं, जिसमें अवलोकनकर्ताओं ने नोट किया है कि मार्च का फ्लैगशिप प्रदर्शन अब अपने पिछले टोकन मूल्य के एक अंश पर उपलब्ध है।