llama.cpp 프로젝트는 Hexagon 백엔드에서 타일화된 Q4_0 및 Q8_0 GET_ROWS 연산에 대한 지원을 도입한 빌드 b11207을 출시했습니다. 이 업데이트에는 매크로, 레지스터 스플릴 및 DMA 파이프라인에 대한 수정과 함께 커널 선택 로직 개선 및 벡터화 재활성화가 포함됩니다.
- 타일화된 HVX 디큐안티제이션을 사용하여 Hexagon용 Q4_0 및 Q8_0 GET_ROWS에 대한 타일 지원을 추가했습니다.
- 지원되지 않는 연산에 대한 검사를 정리하는 동안 hex-get-rows의 매크로 및 레지스터 스플릴을 수정했습니다.
- DMA 파이프라인을 개선하고 커널 선택 로직을 단순화했습니다.
- 샘플러 업데이트 중에 회귀가 발견된 후 벡터라이저를 다시 활성화했습니다.
이 릴리스는 CPU, GPU, NPU, CUDA, ROCm, Vulkan, OpenVINO 및 SYCL을 포함한 다양한 하드웨어 백엔드에 대해 macOS, Linux, Windows, Android 및 openEuler용 바이너리를 제공합니다.