أصدر مشروع llama.cpp الإصدار b10868، الذي يقدم معالجة أنواع IQ لنماذج Mixture of Experts (MoE).

  • يضيف دعمًا لأنواع الكمية IQ داخل هياكل MoE عبر طلب السحب #28476.
  • يوفر ملفات قابلة للتنفيذ لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، و Windows (CPU، CUDA 12/13، Vulkan، OpenCL، ROCm، SYCL)، و Android، و openEuler.
  • يتضمن دعمًا لإطار عمل iOS XCFramework وحزمة واجهة مستخدم مستقلة.

يتيح هذا التحديث للمستخدمين تشغيل نماذج MoE بأنواع كمية IQ محددة عبر مجموعة واسعة من المنصات الأجهزة.