Proyek llama.cpp telah merilis versi b11260, memperkenalkan dukungan untuk fungsi aktivasi FP32 GELU_ERF dan GEGLU_ERF di backend Hexagon. Pembaruan ini juga mencakup optimasi untuk mengurangi tekanan register dalam kernel terkait.

  • Menambahkan dukungan FP32 GELU_ERF dan GEGLU_ERF untuk Hexagon.
  • Mengurangi tekanan register pada kernel hexagon.
  • Binari tersedia untuk macOS Apple Silicon, Intel, dan iOS.
  • Build Linux mencakup CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL, dan platform Snapdragon.
  • Build Android arm64 mencakup dukungan untuk NPU Snapdragon Hexagon.
  • Rilis Windows menyediakan opsi CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm 10.0.

Rilis ini memperluas kompatibilitas perangkat keras untuk fungsi aktivasi tertentu dan meningkatkan efisiensi pada akselerator yang didukung.