llama.cpp 프로젝트는 Hexagon 활성화 연산에 대한 업데이트를 포함하는 버전 b10098을 출시했습니다. 이 릴리스는 macOS, Linux, Android, Windows 및 openEuler용 바이너리를 다양한 CPU 및 GPU 백엔드에서 제공합니다.

  • 모든 것을 위한 geglu 마이크로커널 (hex-geglu) 최적화
  • hex-geglu에 대한 비연속 소스 및 스트라이드 DMA 활성화
  • 나머지 ACT 연산에 대한 비연속 소스 및 스트라이드 DMA 활성화
  • DEFINE_GLU_PER_THREAD 매크로를 통해 스레드별 GLU 함수 일반화
  • UNARY_SILU 및 UNARY_GELU를 unary-ops로 이동
  • 일반적인 ops_context 스크래치패드 사용 대신 로컬 htp_vtcm_layout 계산으로 대체