Проект llama.cpp отключил ленивую загрузку тензоров по умолчанию для интегрированных GPU (iGPU) в релизе b10867. Это изменение устраняет регрессию, возникшую в предыдущем режиме "AUTO".

  • Обновление откатывает изменения, кроме отключения ленивой загрузки на iGPU в конфигурации AUTO.
  • Исправляется регрессия iGPU путем добавления автоматического исправления режима lazy mode.
  • Предварительно собранные бинарные файлы доступны для macOS, Linux, Windows, Android и openEuler для CPU, CUDA, Vulkan, ROCm и других бэкендов.