llama.cpp 프로젝트는 버전 b10984를 출시하여 행 연속 SUM_ROWS 연산에 대한 CUDA 지원을 도입했습니다. 이 업데이트는 공유 커널을 통해 행 연속 텐서를 처리하기 위해 GGML_OP_MEAN을 포함하도록 코드를 정리합니다.

  • 행 연속 SUM_ROWS에 대한 CUDA 지원 추가.
  • 공유 커널을 사용하여 행 연속 텐서에 대한 GGML_OP_MEAN을 추가하도록 코드 정리.
  • MEAN 치환 및 슬라이스 연산에 대한 테스트 포함.
  • CPU, CUDA, Vulkan, ROCm, OpenVINO 및 SYCL 백엔드에 걸쳐 macOS, Linux, Windows, Android 및 openEuler용 바이너리 제공.

이 릴리스는 로컬 추론을 위해 다양한 하드웨어 가속기 및 운영 체제와의 호환성을 보장합니다.