O projeto llama.cpp lançou a compilação b10688, que inclui um pull request adicionando ajustes de vetor rápido (fa-vec) para a arquitetura M2.

Esta atualização fornece binários e frameworks em várias plataformas e configurações de hardware. As compilações para macOS estão disponíveis para Apple Silicon e Intel, enquanto os usuários de iOS podem acessar um XCFramework. O suporte para Linux cobre variantes de CPU, Vulkan, ROCm 7.14, OpenVINO e SYCL para as arquiteturas x64, arm64 e s390x. Os lançamentos para Windows incluem suporte para CPU, OpenCL Adreno, Vulkan, ROCm 7.14, OpenVINO, SYCL e CUDA 12/13 tanto para x64 quanto para arm64. Binários para Android arm64 também são fornecidos.

O lançamento permite que os usuários executem o llama.cpp em uma ampla gama de dispositivos e aceleradores usando os artefatos de compilação mais recentes.