llama.cpp 프로젝트는 가중치 백엔드로 연산을 오프로드하는 ggml 로직에 대한 조정을 포함한 빌드 b10150을 출시했습니다. 이 업데이트는 llama dsv4 그래프에 대한 수정도 다룹니다.
- ggml: 가중치 백엔드로 연산 오프로딩 로직 조정
- llama: dsv4 그래프 수정
이번 릴리스에서는 CPU, CUDA, Vulkan, ROCm, OpenVINO을 포함한 다양한 하드웨어 백엔드에 대해 macOS, Linux, Windows, Android, iOS용 업데이트된 바이너리를 제공합니다.