llama.cpp 프로젝트는 Apple M3 Pro 칩에 특별히 빠른 벡터(fa-vec) 튜닝을 추가하는 풀 리퀘스트를 포함하는 빌드 b10696을 출시했습니다.
이 업데이트는 특정 하드웨어 구성에서 성능을 개선하기 위해 이슈 #27668을 해결합니다. 이번 릴리스는 CPU, CUDA, ROCm, Vulkan, OpenVINO 및 SYCL을 비롯한 다양한 백엔드를 통해 macOS, iOS, Linux, Windows, Android 및 openEuler용 바이너리를 제공합니다.
fa-vec 튜닝은 M3 Pro 프로세서를 갖춘 장치에서 llama.cpp를 실행하는 사용자의 추론 속도 또는 효율성을 최적화하기 위한 것입니다.