llama.cpp 프로젝트는 작업 메모리 크기를 제한하는 변경 사항을 포함하는 빌드 b10656을 출시했습니다. 이 수정은 시스템 RAM에 큰 텐서가 로드되는 것을 방지하기 위해 설계되었습니다.
- 해당 릴리스는 macOS (Apple Silicon 및 Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Android, Windows 및 openEuler용 바이너리를 제공합니다.
- 지원되는 백엔드에는 CPU, Vulkan, ROCm 7.14, OpenVINO, SYCL, CUDA 12/13 및 OpenCL Adreno가 포함됩니다.
- 이 빌드에서는 macOS Apple Silicon에 대한 KleidiAI 지원이 비활성화되었습니다.
이 업데이트는 작업 메모리 사용량을 제한하여 양자화 프로세스 동안 더 안정적인 메모리 사용을 보장합니다.