O projeto llama.cpp lançou a compilação b11158, que inclui um ajuste do suporte a matrizes cooperativas KHR especificamente para GPUs Adreno por meio do backend Vulkan.

  • Suporte a matrizes cooperativas (coopmat) habilitado para o backend Vulkan para melhorar o desempenho em hardware compatível.
  • Corrigida a função mul_mat_s dentro da implementação.
  • Removidas instruções de depuração do código-fonte.

Esta atualização fornece aceleração de GPU otimizada para dispositivos Snapdragon executando Linux e Android, bem como sistemas Windows arm64 com gráficos Adreno.