llama.cpp 프로젝트는 Vulkan 백엔드에 대한 중요한 업데이트를 포함한 빌드 b10883을 출시했습니다. 주요 변경 사항에는 셰이더 컴파일 및 성능을 개선하기 위해 행렬-행렬 곱셈 A형 연산에 spec constant를 사용하는 것이 포함됩니다.
- Vulkan 셰이더에서 mul mat type_a에 spec constant 사용.
- 공유 메모리 테이블 통합 및 유형 spec constant를 통해 크기 축소.
- Ampere 회귀 수정을 위해 coopmat2 q4_k/q5_k 최적화 복원 및 셰이더 분리.
- cm2 행렬 곱셈에서 누락된 Q2_0 유형 수정 및 f16 Intel 튜닝 변경 사항 적응.
- 최소 공유 메모리 크기 8을 사용하여 cm2 컴파일러 버그 우회.
이번 릴리스는 CPU, GPU 및 전용 하드웨어 백엔드를 위한 macOS, Linux, Windows, Android 및 openEuler용 업데이트된 바이너리를 제공합니다.