O projeto llama.cpp lançou a versão b11044, que inclui uma atualização no backend hexagon para melhorar as operações image-to-column (im2col). O lançamento fornece binários pré-compilados para macOS, Linux, Windows, Android e openEuler em CPU, GPU e outros aceleradores de hardware.

  • ggml-hexagon agora aceita operações IM2COL 1D e com preenchimento.
  • O kernel IM2COL pure-DDR tornou-se aware de 2D.
  • O caminho rápido do patch-embed IM2COL DMA foi estendido para 1D.
  • Um kernel general blocked-staging IM2COL DMA foi adicionado.