Проект llama.cpp выпустил версию b11019, устраняющую критическую ошибку, при которой файлы GGUF, встроенные по невыровненным смещениям, возвращали некорректные данные тензоров. Обновление выравнивает секцию данных GGUF относительно начала файла, а не смещения 0, обеспечивая правильную загрузку встроенных моделей.
- Исправлена gguf_init_from_file_ptr для заполнения секции данных от начала GGUF, предотвращая ошибки с невыровненными встроенными файлами.
- Добавлена llama_adapter_lora_init_from_file_ptr для включения загрузки адаптеров LoRA через потоки FILE*.
- Отключено mmap с предупреждением, когда встроенная секция данных не выровнена, заменяя предыдущие утверждения в ggml.
- Включены бинарные файлы для macOS (Apple Silicon и Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL), Android, Windows и openEuler.
Этот релиз обеспечивает надёжную работу файлов GGUF, встроенных в другие контейнеры или расположенных по произвольным смещениям файла.