Komponen webgpu telah menambahkan dukungan untuk format MMVQ (Multi-Mode Vector Quantization), khususnya Q1_0, Q5_0, Q5_1, Q3_K, Q5_K, Q6_K, dan MXFP4.
Pembaruan ini mengatasi issue #29 di repositori llama.cpp untuk memperluas kemampuan kuantisasi dalam lingkungan webgpu.