El proyecto llama.cpp ha añadido ajustes de vector de atención rápida (fa-vec) para la GPU Apple M4 Pro a través de una nueva contribución al backend Metal. Esta actualización sigue al trabajo previo para soportar GPUs adicionales de Apple y fue generada usando la herramienta `ggml-metal-tuning` en un MacBook Pro de 14 pulgadas de noviembre de 2024.
- El proceso de ajuste se ejecutó con éxito en 1 hora, 13 minutos y 1 segundo sin otra carga del sistema.
- La contribución soporta los tipos de datos f16 y q8_0 para la arquitectura M4 Pro.
- Esta versión incluye binarios para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA, Vulkan, OpenCL, ROCm, OpenVINO, SYCL) y openEuler.