llama.cpp 프로젝트는 SYCL의 호스트-ToDevice 메모리 액세스를 개선하기 위해 호스트 고정 메모리에 대한 지원을 도입한 버전 b10418을 출시했습니다. 이 업데이트는 백엔드 구현 내의 스레드 안전성 문제를 해결합니다.

  • 호스트 고정 메모리를 위한 ggml_backend_sycl_host_buffer_type_get_max_size 지원을 추가합니다.
  • SYCL 백엔드의 스레드 안전 문제를 수정합니다.
  • macOS(Apple Silicon 및 Intel), Linux(CPU, Vulkan, ROCm, OpenVINO, SYCL FP32/FP16), Android, Windows(CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 7.14) 및 openEuler용 바이너리를 포함합니다.
  • 모든 플랫폼을 위한 통합 UI 패키지를 제공합니다.

이 릴리스는 SYCL 호환 하드웨어에 대해 호스트와 장치 메모리 간 더 빠른 데이터 전송을 가능하게 하며, 개선된 스레드 안전성을 통해 안정성을 보장합니다.