في المؤتمر الـ 37 لـ Hot Chips، قدمت OpenAI تفاصيل معايير الأداء لرقاقة الاستدعاء المخصصة لها، خالخيخينو، مدعية أداءً أفضل لكل واط مقارنة بأنظمة GB200 وGB300 من NVIDIA. توفر الرقاقة عملاً أكثر بنسبة 1.5–1.9× لكل واط عند ذروة الإنتاجية وزمن استجابة نهائي أقل بنسبة 1.7–3.6×، مع جدولة نشرها في بنية OpenAI التحتية بحلول نهاية العام.

  • حققت خالخيخينو أداءً أعلى بنسبة 2.1–4.1× للأحمال العملية التفاعلية للغاية مع البقاء عند أو دون 550 واط رغم تصنيفها بـ 700 واط.
  • تقلل البنية من المقايضة التقليدية بين الإنتاجية وزمن الاستجابة، وتؤدي أداءً جيداً حتى بدون تفكيك مكثف للتهيئة/الاستدعاء أو فك التشفير التخميني.
  • استخدمت OpenAI نماذج GPT-Astra وCodex لتحسين النوى منخفضة المستوى، مما جلب ثلاثة نماذج مفتوحة الأوزان إلى أداء عالٍ في شهرين بسرعات أسرع بنسبة 1.5–1.8× مقارنة بالكود المكتوب بشرياً.
  • شملت الإعلانات الأخرى تحسينات إطار عمل AutoSaddler من Microsoft، والحاسوب المحمول المحلي الأول من Perplexity على NVIDIA DGX Spark، ورؤى جديدة حول أنظمة ذاكرة الوكلاء.