Проект llama.cpp выпустил сборку b10447, включающую переработку модели потоков `yield_to_queue`. Это изменение предполагает запуск `common_speculative_process` в рабочем потоке и замену дизайна взаимодействия рабочего потока с главным.
Релиз предоставляет бинарные файлы для macOS (Apple Silicon и Intel), Linux (Ubuntu с CPU, Vulkan, OpenVINO, SYCL и отключенным ROCm), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL и ROCm 7.14) и openEuler (с некоторыми отключенными сборками).
Это обновление доступно для загрузки на всех поддерживаемых платформах.