El proyecto llama.cpp lanzó la versión b11019, corrigiendo un error crítico en el que los archivos GGUF embebidos en desplazamientos no alineados devolvían datos de tensor incorrectos. La actualización alinea la sección de datos GGUF con respecto al inicio del archivo en lugar del desplazamiento 0, asegurando la carga correcta de modelos embebidos.
- Corrige gguf_init_from_file_ptr para rellenar la sección de datos desde el inicio de GGUF, evitando errores con archivos embebidos no alineados.
- Añade llama_adapter_lora_init_from_file_ptr para habilitar la carga de adaptadores LoRA a través de flujos FILE*.
- Desactiva mmap con una advertencia cuando una sección de datos embebida no está alineada, reemplazando las aserciones anteriores en ggml.
- Incluye binarios para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL), Android, Windows y openEuler.
Esta versión garantiza el funcionamiento fiable de archivos GGUF embebidos dentro de otros contenedores o en desplazamientos de archivo arbitrarios.