أصدر مشروع llama.cpp الإصدار b10868، الذي يقدم معالجة أنواع IQ لنماذج Mixture of Experts (MoE).
- يضيف دعمًا لأنواع الكمية IQ داخل هياكل MoE عبر طلب السحب #28476.
- يوفر ملفات قابلة للتنفيذ لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، و Windows (CPU، CUDA 12/13، Vulkan، OpenCL، ROCm، SYCL)، و Android، و openEuler.
- يتضمن دعمًا لإطار عمل iOS XCFramework وحزمة واجهة مستخدم مستقلة.
يتيح هذا التحديث للمستخدمين تشغيل نماذج MoE بأنواع كمية IQ محددة عبر مجموعة واسعة من المنصات الأجهزة.