Проект llama.cpp выпустил сборку b10290, внедрив новую функцию `ggml_build_forward_order` в библиотеку ggml. Это изменение устраняет ошибку в графе аудио mtmd, где использование `ggml_build_forward_expand` в качестве чистого указания порядка приводило к выполнению неселектированных ветвей со старыми данными.

  • Предыдущий метод принудительно выполнял вычисления на неселектированных ветвях, что приводило к ошибкам проверки границ `get_rows` на CPU из-за устаревших данных `inp_code0`.
  • Новая функция вставляет узлы без флага вычислений, восстанавливая его только тогда, когда ветвь фактически выбирается.
  • Сборка b10290 предоставляет бинарные файлы для macOS (Apple Silicon и Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, HIP) и openEuler.
  • В релиз также включены iOS XCFramework и автономная сборка UI.