llama.cpp b10831 릴리스는 Vulkan 백엔드에 대한 TQ1_0 양자화 지원을 도입하여 행렬 곱셈, mat-vec, 역양자화, get_rows 등의 연산을 가능하게 합니다. 이 업데이트는 또한 Metal 백엔드를 수정하여 지원되지 않는 TQ1_0 연산을 적절히 거부하고 CPU 실행으로 폴백되도록 보장합니다.
- Vulkan 구현은 레지스터 문제를 피하기 위해 TQ1_0의 3의 거듭제곱을 32비트 상수로 패킹합니다.
- types.glsl의 공유 디코드 헬퍼가 다양한 셰이더 파일 간에 중복된 로직을 대체합니다.
- 독립형 역양자화 셰이더의 워크그룹 분모 계산 버그가 수정되었습니다.
- Metal 백엔드는 GET_ROWS 및 mat-mul에 대해 TQ1_0을 거부하여 기존 NVFP4 처리와 일치합니다.
- 테스트 케이스가 축소되고 주석이 ASCII로 표준화되었습니다.
Vulkan 변경 사항은 AMD gfx1151에서 검증되었으며 모든 관련 백엔드 연산이 테스트를 통과했습니다.