O projeto llama.cpp lançou a versão b11055, que introduz suporte à função de ativação GEGLU_QUICK em DSPs Hexagon.

  • O lançamento inclui binários para macOS (Apple Silicon e Intel), Linux (Ubuntu x64, arm64, s390x), Windows e Android.
  • A aceleração de GPU é suportada via CUDA 12.8/13.3, ROCm 10.0, Vulkan, OpenVINO e SYCL no Linux, bem como CUDA, OpenCL, Vulkan, OpenVINO e SYCL no Windows.
  • As compilações do macOS Apple Silicon com KleidiAI estão atualmente desativadas.
  • O suporte ao openEuler também está listado, embora algumas configurações estejam marcadas como desativadas.

Esta atualização oferece aos usuários maior compatibilidade com hardware e capacidades de inferência otimizadas para dispositivos baseados em Hexagon.