Проект llama.cpp выпустил версию b11019, устраняющую критическую ошибку, при которой файлы GGUF, встроенные по невыровненным смещениям, возвращали некорректные данные тензоров. Обновление выравнивает секцию данных GGUF относительно начала файла, а не смещения 0, обеспечивая правильную загрузку встроенных моделей.

  • Исправлена gguf_init_from_file_ptr для заполнения секции данных от начала GGUF, предотвращая ошибки с невыровненными встроенными файлами.
  • Добавлена llama_adapter_lora_init_from_file_ptr для включения загрузки адаптеров LoRA через потоки FILE*.
  • Отключено mmap с предупреждением, когда встроенная секция данных не выровнена, заменяя предыдущие утверждения в ggml.
  • Включены бинарные файлы для macOS (Apple Silicon и Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL), Android, Windows и openEuler.

Этот релиз обеспечивает надёжную работу файлов GGUF, встроенных в другие контейнеры или расположенных по произвольным смещениям файла.