llama.cpp 프로젝트가 버전 b10795를 출시했으며, 여기에는 SYCL 백엔드를 위한 새로운 최적화가 포함되어 있습니다. 이 업데이트는 GGML_SYCL_ENABLE_FUSION 플래그 하에서 RMS_NORM+MUL+ADD 및 ADD+ADD 잔여 체인의 융합을 활성화합니다.
- 융합된 ADD+ADD 연산은 독립적인 add() 함수와 동일한 브로드캐스트 인덱싱 및 타입 행렬을 재사용하며, f32, f16, i32, i16, bf16 및 비연속 데이터를 지원합니다.
- 융합 로직에서 지원되지 않는 조합은 호환성을 유지하기 위해 두 개의 별도 add() 실행으로 폴백됩니다.
이 릴리스는 CUDA, ROCm, Vulkan, OpenVINO을 포함한 다양한 하드웨어 가속기용 macOS, Linux, Windows, Android, openEuler 이진 파일을 제공합니다.