llama.cpp 프로젝트는 dflash 및 dspark 백엔드에 대한 백엔드 샘플링 지원을 도입한 버전 b10412를 출시했습니다. 이 업데이트는 또한 백엔드 샘플링 로직 내에서 0보다 큰 p_min 값을 허용하고 해당 보호 장치를 추가합니다.

  • dflash 및 dspark에 대한 백엔드 샘플링 활성화.
  • 보호 장치를 추가하여 백엔드 샘플링에서 p_min > 0 허용.
  • macOS (Apple Silicon 및 Intel), Linux (CPU, Vulkan, OpenVINO, SYCL), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, openEuler용 바이너리 제공.

이 릴리스는 llama.cpp 사용자를 위한 사용 가능한 하드웨어 가속 옵션을 확장합니다.