O projeto llama.cpp lançou a versão b10291, que inclui correções críticas para o backend do Vulkan junto com atualizações padrão da plataforma. As principais alterações técnicas abordam problemas de tamanho do lote de submissão e introduzem novas capacidades de diagnóstico para erros do driver.

  • Corrige um bug onde o limite de submissão era aplicado tarde demais no pipeline do Vulkan.
  • Adiciona ferramentas de depuração para fornecer informações mais detalhadas ao diagnosticar erros do driver DeviceLost.
  • Substitui chamadas abort por exceções throw e implementa macros de log para melhor tratamento de erros.
  • Limpa dependências circulares dentro da base de código.

Este lançamento melhora a estabilidade para usuários que executam o llama.cpp em hardware habilitado para Vulkan, resolvendo problemas específicos de temporização de submissão e oferecendo melhor visibilidade das causas de falhas.