llama.cpp 프로젝트는 버전 b10870을 출시하며 Intel coopmat1 하드웨어를 위한 f16 B형 행렬 곱셈 파이프라인 및 와프 타일 크기 튜닝에 대한 Vulkan 지원을 도입했습니다.
- Intel coopmat1을 위한 f16 B형 행렬 곱셈 파이프라인과 와프 타일 크기 튜닝 추가.
- 모든 벤더에 대해 밀집 행렬 곱셈용 f16 B형 파이프라인을 활성화하고, Mixture of Experts (MoE) 지원은 Intel 전용으로 유지.
- 누락된 OCP FP4 분기 추가 및 required_subgroup_size를 Intel로 제한.
- mul_mat_id 내의 mmp 선택 간소화 및 정제.
이 업데이트는 특정 행렬 연산에 대한 Vulkan 호환성을 확장하고 하드웨어 활용도를 개선하기 위해 내부 선택 로직을 정제했습니다.