llama.cpp 프로젝트는 여러 하드웨어 백엔드에서 `ggml_rope_set_offset` 함수에 대한 지원을 도입한 빌드 b10509를 출시했습니다. 이 업데이트에는 새로운 연산에 대한 CPU, Metal, CUDA 및 Vulkan 구현이 포함됩니다.

  • `ggml_rope_set_offset` 매개변수 및 CPU 커널 구현 추가.
  • 새로운 rope 오프셋 기능에 대한 Metal 커널 지원 구현.
  • `supports_op` 가드를 제거하면서 `ggml_rope_set_offset`에 대한 CUDA 지원 활성화.
  • Linux와 Windows 모두에서 `ggml_rope_set_offset`에 대한 Vulkan 백엔드 지원 추가.
  • 관련 연산에서 인플레이스 최적화 제거.

릴리스는 CPU, GPU 및 OpenVINO 및 SYCL과 같은 전용 가속기를 포함한 다양한 아키텍처를 위한 macOS, iOS, Linux, Android, Windows 및 openEuler용 사전 컴파일된 바이너리를 제공합니다.