llama.cpp 프로젝트는 TENSOR_READ_LAZY 처리 메커니즘에 대한 개선을 포함하는 버전 b10705를 출시했습니다. 이 업데이트는 지연 설정이 활성화된 경우 CPU에서 지연 텐서를 강제로 로드합니다.
- llama.cpp의 TENSOR_READ_LAZY 처리 개선
- 지연 모드가 활성화된 경우 CPU에서 지연 텐서 동작 강제
이 릴리스는 CPU, CUDA, ROCm, Vulkan 및 OpenVINO를 포함한 다양한 하드웨어 백엔드에 대해 macOS, Linux, Windows, Android 및 iOS용 업데이트된 바이너리를 제공합니다.