Проект llama.cpp выпустил сборку b10721, которая включает критическое исправление для бэкенда WebGPU и расширяет поддержку оборудования на Windows.
- Исправлен сбой в реализации `ggml_backend_tensor_get()` бэкенда WebGPU при смещении, не кратном 4.
- Добавлена предварительная поддержка arm64 для Windows с CUDA 13.4.
- Предоставлены двоичные файлы для macOS (Apple Silicon и Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android и Windows для различных бэкендов CPU и GPU.
Это обновление обеспечивает стабильность для пользователей WebGPU с невыровненными смещениями памяти и расширяет совместимость с новыми архитектурами CUDA на Windows.