أطلقت تايب سيف آي جيف، وهو فئة جديدة من نماذج "النظام الأول" مصمّمة لبيئات الإنتاج. يجادل ديغو ألميدا، الرئيس التنفيذي للشركة والمؤلف المشارك لورقة إنستركت جي بي تي (InstructGPT)، بأن النماذج المتقدمة الحالية أولت الأولوية للمواءمة والرفض على حساب الموثوقية، ما أدى إلى مشكلات مثل الهلوسة والخضوع المفرط.
- يستخدم جيف تقنية تدريب جديدة تُدعى تعلّم التعزيز للقرارات المُعايرة (RLCD)، والتي تحسّن الاحتمالات الصادقة معرفياً بدلاً من التغذية الراجعة المُقيّمة بشرياً أو المخرجات القابلة للتحقق برمجياً.
- يهدف النموذج إلى "الاندثار في الخلفية" للبرمجيات، ويعمل بموثوقية تعادل التعبيرات النمطية (regex) في مهام مثل استخدام الحاسوب، والتحكم الصوتي، ووكلاء البرمجة.
- تخطط تايب سيف آي لإطلاق نماذج مستقبلية مثل ريزننج جيف (ReasoningJev)، مع التركيز على الذكاء الاصطناعي القابل للتركيب والبرمجة للأتمتة بدلاً من مساعدي الدردشة العامةين.
يعالج هذا النهج مشكلة المعايرة الكامنة في طرق التدريب السابقة، مما يمكّن جيف من أن يكون أساساً متيناً لسير العمل الآلي وتطبيقات البرمجيات الذكية.