O projeto llama.cpp lançou a versão b10098, que inclui uma atualização nas operações de ativação Hexagon. Esta versão fornece binários para macOS, Linux, Android, Windows e openEuler em vários backends de CPU e GPU.

  • Microkernel geglu tudo-em-um otimizado (hex-geglu)
  • Habilitado fonte não contígua e DMA estridido para hex-geglu
  • Habilitado fonte não contígua e DMA estridido para o restante das operações ACT
  • Generalizadas funções GLU por thread via macro DEFINE_GLU_PER_THREAD
  • Movidos UNARY_SILU e UNARY_GELU para unary-ops
  • Substituído o uso genérico do scratchpad ops_context pelo cálculo local htp_vtcm_layout