Проект llama.cpp выпустил сборку b10269, которая включает исправление проблемы с dflash wo_a reshape во время загрузки модели.

Этот релиз предоставляет бинарные файлы для macOS (Apple Silicon и Intel), iOS, Linux (Ubuntu x64, arm64, s390x с CPU, Vulkan, ROCm 7.2, OpenVINO и SYCL бэкендами), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) и openEuler (x86 и aarch64 с ACL Graph).

Обновление доступно для загрузки на всех поддерживаемых платформах, чтобы обеспечить корректное поведение при загрузке модели.