Проект llama.cpp выпустил сборку b10150, которая включает корректировки логики ggml для операций выгрузки на бэкенд весов. Это обновление также содержит исправления для графа llama dsv4.
- ggml: корректировка логики выгрузки операций на бэкенд весов
- llama: исправления графа dsv4
В этом релизе представлены обновлённые бинарные файлы для macOS, Linux, Windows, Android и iOS для различных аппаратных бэкендов, включая CPU, CUDA, Vulkan, ROCm и OpenVINO.