نشرت OpenAI تفاصيل المعايير لأشيتها الخاصة للاستدلال، خولابينو، مدعية كفاءة أعلى وزمن استجابة أقل مقارنةً بأنظمة NVIDIA GB200/GB300. وفي الوقت نفسه، أطلقت بيربلكسيتي الحاسوب المحمول على عتاد NVIDIA DGX Spark، مما يتيح التنسيق المحلي الكامل للوكلاء دون الاعتماد على السحابة.
- حققت شريحة خولابينو من OpenAI عملاً أكثر بنسبة 1.5–1.9× لكل واط وزمن استجابة نهائي أقل بنسبة 1.7–3.6× مقارنةً بأنظمة NVIDIA في الاختبارات.
- تبلغ قدرة الشريحة 700W لكنها بقيت دون 550W أثناء الاختبار، مع التخطيط لنشرها بنهاية العام.
- يعمل الحاسوب المحمول من بيربلكسيتي على نموذج اللغة الرئيسي (LLM)، ونموذج اللغة الوكيل الفرعي، وإطار عمل الوكيل محلياً باستخدام PPLX 27B أو Qwen 3.8 27B.
- أفاد مشروع AutoSaddler بقيادة Microsoft بتحسينات قدرها +9.0 على GAIA2 و+10.0 على Terminal-Bench 2.0 من خلال معالجة إطار عمل الوكيل ككود.
- وجد SWE Refactor Bench أن معدل البقاء فقط 5.4٪ لمهام ترحيل المستودع بأكمله عبر 520 تشغيلاً.
تسلط هذه التطورات الضوء على تحول نحو عتاد استدلال متخصص وهندسة معمارية للوكلاء تعتمد على المحلي أولاً، مما يقلل الاعتماد على البنية التحتية للسحابة.