أضاف مكون webgpu الدعم لتنسيقات MMVQ (Multi-Mode Vector Quantization)، وتحديداً Q1_0 و Q5_0 و Q5_1 و Q3_K و Q5_K و Q6_K و MXFP4.

يعالج هذا التحديث المشكلة #29 في مستودع llama.cpp لتوسيع قدرات الكمّية داخل بيئة webgpu.