llama.cpp 프로젝트가 Apple Silicon 장치용 Metal 백엔드 업데이트를 포함한 버전 b10816을 출시했습니다. 이번 릴리스는 M3 칩 아키텍처에 대한 나머지 fast-vector 튜닝 추가에 중점을 둡니다.
- fa_vec_tuned_table에 M3 항목 추가.
- ggml-metal-tuning에 q4_0, q4_1, q5_0 및 q5_1 양자화 포함.
- macOS (Apple Silicon 및 Intel), iOS, Linux, Windows, Android 및 openEuler용 바이너리 제공.
- CPU, Vulkan, ROCm 10.0, OpenVINO, SYCL, CUDA 12/13 및 OpenCL Adreno를 포함한 다양한 백엔드 지원.
이 업데이트는 M3 하드웨어에 대한 최적화된 성능을 보장하면서 여러 운영 체제와 GPU 아키텍처에서 사전 빌드된 바이너리의 가용성을 확장합니다.