llama.cpp 프로젝트는 버전 b10442를 출시하며, 행렬 곱셈 루틴의 메모리 안전성 문제를 해결하는 동시에 Intel Xe 하드웨어에 대한 특정 Vulkan 최적화를 도입했습니다.

  • Intel Xe의 coopmat mul_mm에 대해 SHMEM_STRIDE_PAD 및 APPLY_SLM_A_RESHAPE 플래그 추가.
  • matmul_shmem_support에서 Intel SHMEM_STRIDE_PAD=0에 대한 공유 메모리 추정을 수정.
  • 데이터 처리를 개선하기 위해 공유 kvalues_mxfp4에 대한 캐시라인 정렬 구현.
  • 캐시라인 패딩 변경 후 kvalues_mxfp4 초기화 시 경계 밖 읽기(OOB) 문제 해결.
  • SLM-A 재구성 조정을 Intel Windows 드라이버로 제한하고 필요한 경우 mxfp4 캐시라인 패딩을 되돌림.

이 릴리스는 CPU, Vulkan, CUDA, ROCm, OpenVINO 및 SYCL 백엔드를 위한 macOS, Linux, Windows, Android 및 openEuler용 업데이트된 바이너리를 제공합니다.