Proyek llama.cpp merilis versi b11019, yang mengatasi bug kritis di mana file GGUF yang tertanam pada offset yang tidak sejajar mengembalikan data tensor yang salah. Pembaruan ini menyelaraskan bagian data GGUF relatif terhadap awal file, bukan offset 0, memastikan pemuatan model tertanam berjalan benar.

  • Memperbaiki gguf_init_from_file_ptr untuk mengisi bagian data dari awal GGUF, mencegah kesalahan pada file tertanam yang tidak sejajar.
  • Menambahkan llama_adapter_lora_init_from_file_ptr untuk memungkinkan pemuatan adapter LoRA melalui aliran FILE*.
  • Menonaktifkan mmap dengan peringatan ketika bagian data tertanam tidak sejajar, menggantikan assertion sebelumnya di ggml.
  • Menyertakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL), Android, Windows, dan openEuler.

Rilis ini memastikan operasi yang andal untuk file GGUF yang tertanam dalam wadah lain atau pada offset file sembarang.