O projeto llama.cpp lançou a versão b11019, corrigindo um bug crítico em que arquivos GGUF embutidos em deslocamentos não alinhados retornavam dados de tensor incorretos. A atualização alinha a seção de dados do GGUF em relação ao início do arquivo, em vez do deslocamento 0, garantindo o carregamento correto de modelos embutidos.
- Corrige gguf_init_from_file_ptr para preencher com zeros (pad) a seção de dados a partir do início do GGUF, impedindo erros com arquivos embutidos não alinhados.
- Adiciona llama_adapter_lora_init_from_file_ptr para habilitar o carregamento de adaptadores LoRA por meio de fluxos FILE*.
- Desativa mmap com um aviso quando uma seção de dados embutida não está alinhada, substituindo as asserções anteriores em ggml.
- Inclui binários para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL), Android, Windows e openEuler.
Esta versão garante o funcionamento confiável de arquivos GGUF embutidos dentro de outros contêineres ou em deslocamentos arbitrários de arquivo.