أطلقت OpenAI عائلة نماذج GPT-5.6، المصممة لتقديم أداء وكيل على مستوى متقدم بتكاليف أقل بشكل ملحوظ من خلال تحسين جهد الاستدلال وإدخال عناصر تحكم جديدة في واجهة برمجة التطبيقات (API). يتيح التحديث للشركات الناشئة بناء وكلاء أسرع وأكثر قدرة باستخدام نماذج أصغر مثل Luna وTerra للمهام عالية الحجم، مع الاحتفاظ بالنماذج الأكبر للحكم المعقد.

  • يتفوق GPT-5.6 Sol عند مستوى "منخفض" من الاستدلال على GPT-5.5 عند مستوى "مرتفع" في اختبار Agents’ Last Exam تحت ظروف سباق ثابتة.
  • في معيار BrowseComp، حصل GPT-5.6 Luna على 84.04% مقابل 1.33 دولار، مقارنة بـ 84.36% لـ GPT-5.5 مقابل 33.27 دولار.
  • تشمل بدائع واجهة برمجة التطبيقات للاستجابات الجديدة الاستدلال الدائم، والضغط الأصلي، وتنسيق الوكلاء المتعددين، واستدعاء الأدوات برمجياً.
  • أدى تمكين الاستدلال المحتفظ به والضغط على ARC-AGI-3 إلى زيادة نتيجة GPT-5.6 Sol من 13.3% إلى 38.3% مع استخدام حوالي سدس عدد رموز الإخراج.
  • يتم تمديد مدة صلاحية ذاكرة التخزين المؤقت للرسالة (TTL) لواجهة برمجة التطبيقات إلى حد أدنى يبلغ 30 دقيقة مع نقاط توقف ذاكرة تخزين مؤقت حتمية لتحسين معدلات الإصابة وتقليل زمن الوصول.

تُغيّر هذه التغييرات اقتصاديات بناء الوكلاء، مما يتيح نتائج قابلة للمقارنة أو أفضل بكسر من التكلفة من خلال استخدام نماذج أصغر واختيارات معمارية فعالة.