O projeto llama.cpp lançou a versão b10098, que inclui uma atualização nas operações de ativação Hexagon. Esta versão fornece binários para macOS, Linux, Android, Windows e openEuler em vários backends de CPU e GPU.
- Microkernel geglu tudo-em-um otimizado (hex-geglu)
- Habilitado fonte não contígua e DMA estridido para hex-geglu
- Habilitado fonte não contígua e DMA estridido para o restante das operações ACT
- Generalizadas funções GLU por thread via macro DEFINE_GLU_PER_THREAD
- Movidos UNARY_SILU e UNARY_GELU para unary-ops
- Substituído o uso genérico do scratchpad ops_context pelo cálculo local htp_vtcm_layout