llama.cpp 프로젝트는 ROCm 백엔드 내에서 AllReduce 연산을 활성화하는 지원을 도입한 버전 b10989를 출시했습니다. 이 업데이트는 대규모 언어 모델 추론을 위한 하드웨어 호환성 및 분산 컴퓨팅 기능을 확장하기 위한 지속적인 개발의 일환입니다.

  • macOS(Apple Silicon 및 Intel), Linux(Ubuntu x64, arm64, s390x), Windows, Android용 사전 빌드된 바이너리가 포함되어 있습니다.
  • GPU 가속 옵션이 CUDA 12.8/13.3, Vulkan, OpenVINO, SYCL FP32/FP16 및 지원되는 플랫폼 전반의 ROCm 10.0을 포함하도록 확장되었습니다.
  • 910b 프로세서에서 ACL Graph 지원을 포함한 openEuler x86 및 aarch64 아키텍처용 특정 빌드가 제공됩니다.
  • 핵심 라이브러리 출시와 함께 독립형 UI 바이너리도 제공됩니다.

이 릴리스를 통해 사용자는 AllReduce 기능을 갖춘 ROCm 기반 AMD GPU를 활용할 수 있으며, 다양한 운영 체제 및 하드웨어 가속기를 위한 업데이트된 바이너리를 제공합니다.