Проект llama.cpp отключил ленивую загрузку тензоров по умолчанию для интегрированных GPU (iGPU) в релизе b10867. Это изменение устраняет регрессию, возникшую в предыдущем режиме "AUTO".
- Обновление откатывает изменения, кроме отключения ленивой загрузки на iGPU в конфигурации AUTO.
- Исправляется регрессия iGPU путем добавления автоматического исправления режима lazy mode.
- Предварительно собранные бинарные файлы доступны для macOS, Linux, Windows, Android и openEuler для CPU, CUDA, Vulkan, ROCm и других бэкендов.