O projeto llama.cpp lançou a compilação b10696, que inclui um pull request adicionando o ajuste rápido de vetores (fa-vec) especificamente para o chip Apple M3 Pro.

Esta atualização aborda o problema #27668 para melhorar o desempenho nesta configuração de hardware específica. O lançamento fornece binários para macOS, iOS, Linux, Windows, Android e openEuler através de vários backends incluindo CPU, CUDA, ROCm, Vulkan, OpenVINO e SYCL.

O ajuste fa-vec tem como objetivo otimizar a velocidade ou eficiência de inferência para usuários que executam llama.cpp em dispositivos equipados com o processador M3 Pro.