llama.cpp 프로젝트는 `yield_to_queue` 스레드 모델의 재설계를 포함한 빌드 b10447을 출시했습니다. 이 변경 사항에는 워커에서 `common_speculative_process`를 실행하고 워커-메인 스레드 디자인을 교체하는 작업이 포함됩니다.

이번 릴리스는 macOS(Apple Silicon 및 Intel), Linux(Ubuntu용 CPU, Vulkan, OpenVINO, SYCL 및 비활성화된 ROCm), Android, Windows(CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL 및 ROCm 7.14), openEuler(일부 빌드 비활성화)용 바이너리를 제공합니다.

이 업데이트는 지원되는 모든 플랫폼에서 다운로드할 수 있습니다.