llama.cpp 프로젝트가 서버 구성 요소에 특정 업데이트를 포함한 버전 b10312를 출시했습니다. 주요 변경 사항은 라우터에서 바쁜 모델이 제거되는 문제를 해결하는 것입니다.

  • 서버: 바쁜 모델의 제거 방지 (PR #26567).
  • macOS/iOS: Apple Silicon (arm64) 및 Intel (x64)용 바이너리와 iOS XCFramework를 제공합니다. macOS에서의 KleidiAI 지원은 비활성화되었습니다.
  • Linux: Ubuntu x64, arm64, s390x CPU용 빌드와 함께 Vulkan, ROCm 7.2, OpenVINO, SYCL FP32, SYCL FP16 변형을 제공합니다.
  • Android: arm64 CPU 빌드를 포함합니다.
  • Windows: x64 및 arm64 CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP를 지원합니다.
  • openEuler: x86 (310p, 910b ACL Graph) 및 aarch64 (310p, 910b ACL Graph)용 빌드가 제공되며, 표준 풀 리퀘스트는 비활성화되었습니다.

이번 릴리스는 서버 배포에서 활성 모델의 지속적인 가용성을 보장하고 주요 운영 체제 및 하드웨어 가속기 전반에 걸쳐 포괄적인 바이너리를 제공합니다.