El proyecto llama.cpp lanzó la compilación b10673, que incluye optimizaciones específicas de rendimiento para hardware Apple M4. Esta actualización introduce registros fa_vec_tuned_table en el módulo ggml-metal-tuning para mejorar la eficiencia del backend Metal.
- Agrega tablas de búsqueda ajustadas para cuantizaciones F16, Q4_0, Q4_1, Q5_0, Q5_1 y Q8_0 en chips M4 con 10 núcleos GPU.
- Proporciona binarios para macOS Apple Silicon (arm64), macOS Intel (x64) e iOS XCFramework.
- Incluye compilaciones de Linux para Ubuntu x64 y arm64 a través de los backends CPU, Vulkan, ROCm 7.14, OpenVINO y SYCL.
- Ofrece binarios de Windows para CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL y ROCm 7.14.
- Agrega soporte para Android arm64 (CPU) y binarios de interfaz de usuario.
Este lanzamiento asegura que los usuarios en dispositivos Apple M4 puedan aprovechar kernels Metal optimizados para una inferencia más rápida.