أطلقت loo5x إصدار llama-modes v0.4.0، وهو نسخة مشتقة من llama.cpp تتيح تحميل نموذج GGUF واحد مرة واحدة لأداء أوضاع استدلال هيكلي متعددة دون تبديل النماذج أو إضافة مصنفات.

  • يقيّم وضع BOOLEAN الإجابات بنعم/لا مباشرةً.
  • يقيّم وضع CHOICE المرشحين الموردين بشكل تعسفي، بما في ذلك التسميات متعددة الرموز.
  • يقيّم وضع SCALE المقاييس الترتيبية أو الفاصلة، ويعيد توزيعات منفصلة وإحصائيات مشتقة مثل الوسيط أو القيمة المتوقعة.
  • يتضمن المشروع إصدار CUDA لنظام Windows، وعرض تجريبي محلي باستخدام React، وتوثيق واجهة برمجة التطبيقات.

يتيح هذا النهج للمطورين إعادة استخدام أوزان النموذج نفسها في الذاكرة لمبادئ الاستدلال المختلفة، مما يعرض التقييم الهيكلي مباشرةً من نماذج اللغة المحلية العادية.