Проект llama.cpp выпустил сборку b10150, которая включает корректировки логики ggml для операций выгрузки на бэкенд весов. Это обновление также содержит исправления для графа llama dsv4.

  • ggml: корректировка логики выгрузки операций на бэкенд весов
  • llama: исправления графа dsv4

В этом релизе представлены обновлённые бинарные файлы для macOS, Linux, Windows, Android и iOS для различных аппаратных бэкендов, включая CPU, CUDA, Vulkan, ROCm и OpenVINO.