Proyek llama.cpp telah merilis versi b10663, yang mencakup perbaikan untuk bug offset bobot RMS_NORM_MUL yang mempengaruhi normalisasi berkelompok dan broadcast.
- Memperbaiki bug offset bobot RMS_NORM_MUL untuk normalisasi berkelompok/broadcast (PR #27798).
- Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm 7.14, OpenVINO, SYCL), Android, Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 7.14), dan openEuler.
Rilis ini memastikan perilaku normalisasi yang benar untuk arsitektur model tertentu, sambil menyediakan biner yang diperbarui di seluruh platform yang didukung.