O projeto llama.cpp desativou o carregamento preguiçoso de tensores por padrão para GPUs integradas (iGPUs) na versão b10867. Esta alteração corrige uma regressão introduzida na configuração anterior do modo "AUTO".

  • A atualização reverte alterações, exceto ao desativar o carregamento preguiçoso em iGPUs dentro da configuração AUTO.
  • Corrige uma regressão de iGPU adicionando um ajuste automático específico para o modo lazy mode.
  • Binários pré-compilados estão disponíveis para macOS, Linux, Windows, Android e openEuler através de CPU, CUDA, Vulkan, ROCm e outros backends.