llama.cpp 프로젝트는 모델 로더에 TENSOR_READ_LAZY 기능을 도입한 빌드 b10653을 출시했습니다. 이 변경에는 TENSOR_GET_ROW_LAZY 함수의 추가와 해당하는 --tensor-read-lazy 명령줄 플래그가 포함됩니다.
- 모델 로더에 TENSOR_READ_LAZY 및 TENSOR_GET_ROW_LAZY 추가.
- 지연 텐서 읽기를 활성화하기 위한 --tensor-read-lazy CLI 옵션 도입.
- macOS (Apple Silicon 및 Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android 및 iOS용 바이너리 제공.
이 릴리스는 코어 라이브러리를 새로운 지연 로딩 기능으로 업데이트하며 지원되는 플랫폼 전반에 사전 빌드된 바이너리를 배포합니다.