llama.cpp 프로젝트는 이미지 처리 커널에서 경계 밖 메모리 읽기를 방지하기 위해 Adreno GPU용 OpenCL에 대한 중요한 수정 사항을 포함한 빌드 b10754를 출시했습니다.

  • q4_K 디코드 GEMV 행 가져오기가 패딩된 x-그리드에서 클램프되도록 변경되었습니다.
  • 이미지 KQ/KQV GEMM에 대한 타일링 계약이 엄격하게 적용됩니다.
  • 이미지 KQ/KQV의 분할 로직은 스트라이드에 의존하는 대신 디스패치 시점에 결정됩니다.

이 업데이트는 Adreno 하드웨어에서 OpenCL 가속과 함께 llama.cpp를 실행하는 사용자에게 안정성과 정확성을 보장합니다.