llama.cpp 프로젝트는 인덱서에서 사용되지 않기 때문에 V 캐시를 할당하지 않도록 하는 메모리 최적화가 포함된 빌드 b10889를 출시했습니다.

이 업데이트에서는 macOS (Apple Silicon 및 Intel), iOS, Linux (Ubuntu x64, arm64, s390x with CPU, Vulkan, ROCm 10.0, OpenVINO, SYCL 백엔드), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0) 및 openEuler에 대한 사전 빌드된 바이너리를 제공합니다.

릴리스에는 llama.cpp UI도 포함되어 있습니다.