llama.cpp 프로젝트는 b10867 릴리스에서 내장 GPU(iGPU)에 대해 기본적으로 지연 텐서 로딩을 비활성화했습니다. 이 변경은 이전 "AUTO" 지연 모드 설정에서 도입된 회귀를 해결합니다.
- 업데이트는 AUTO 구성 내에서 iGPU의 지연 로딩 비활성화를 제외하고 변경 사항을 되돌립니다.
- 특정 지연 모드 자동 수정을 추가하여 iGPU 회귀를 수정합니다.
- macOS, Linux, Windows, Android 및 openEuler용 사전 빌드된 바이너리가 CPU, CUDA, Vulkan, ROCm 및 기타 백엔드를 통해 제공됩니다.