Проект llama.cpp выпустил сборку b10721, которая включает критическое исправление для бэкенда WebGPU и расширяет поддержку оборудования на Windows.

  • Исправлен сбой в реализации `ggml_backend_tensor_get()` бэкенда WebGPU при смещении, не кратном 4.
  • Добавлена предварительная поддержка arm64 для Windows с CUDA 13.4.
  • Предоставлены двоичные файлы для macOS (Apple Silicon и Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android и Windows для различных бэкендов CPU и GPU.

Это обновление обеспечивает стабильность для пользователей WebGPU с невыровненными смещениями памяти и расширяет совместимость с новыми архитектурами CUDA на Windows.