أصدر مشروع llama.cpp الإصدار b10921، والذي يتضمن إصلاحًا لـ WebGPU من خلال محاذاة روابط الموترات مع حجم كتلة النوع. يضمن هذا التغيير أن المشاهدات الكمية للكتل تتلقى إزاحة عنصر صالحة في الشيدر عن طريق الرجوع إلى الوراء عبر إزاحة الرابط حتى تصبح المسافة إلى الموتر عددًا صحيحًا من الكتل.
يوفر الإصدار ملفات ثنائية وأطر عمل لنظام macOS (Apple Silicon و Intel) و iOS و Linux (Ubuntu مع خلفيات CPU و Vulkan و ROCm و OpenVINO و SYCL) و Android و Windows (CPU و CUDA 12/13 و Vulkan و OpenVINO و SYCL و ROCm) و openEuler.
يضمن هذا التحديث التعامل الصحيح مع الموترات في شيفرات WebGPU مع الحفاظ على الدعم عبر مجموعة واسعة من بنية الأجهزة وتنفيذات الخلفيات.