أصدر مشروع llama.cpp الإصدار b10336، والذي يتضمن إعادة هيكلة لعدة ملفات wgsl وتبسيط flash_attn wgsl ضمن مكون ggml-webgpu.
يوفر هذا التحديث ثنائيات لأنظمة macOS (Apple Silicon و Intel) و iOS و Linux (Ubuntu مع CPU و Vulkan و ROCm 7.2 و OpenVINO و SYCL) و Android و Windows (CPU و OpenCL و CUDA 12/13 و Vulkan و OpenVINO و SYCL و HIP) ومنصات openEuler.
يتضمن الإصدار أيضًا بناء واجهة المستخدم القياسي لتمكين المستخدمين من التفاعل مع محرك استنتاج النموذج.