Le projet llama.cpp a publié la version b10663, qui inclut une correction pour les bugs de décalage de poids RMS_NORM_MUL affectant les normalisations groupées et diffusées.
- Corrige les bugs de décalage de poids RMS_NORM_MUL pour les normalisations groupées/diffusées (PR #27798).
- Fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, ROCm 7.14, OpenVINO, SYCL), Android, Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 7.14) et openEuler.
Cette version garantit un comportement de normalisation correct pour des architectures de modèles spécifiques, tout en fournissant des binaires mis à jour sur toutes les plateformes prises en charge.