O projeto llama.cpp lançou a compilação b11158, que inclui um ajuste do suporte a matrizes cooperativas KHR especificamente para GPUs Adreno por meio do backend Vulkan.
- Suporte a matrizes cooperativas (coopmat) habilitado para o backend Vulkan para melhorar o desempenho em hardware compatível.
- Corrigida a função mul_mat_s dentro da implementação.
- Removidas instruções de depuração do código-fonte.
Esta atualização fornece aceleração de GPU otimizada para dispositivos Snapdragon executando Linux e Android, bem como sistemas Windows arm64 com gráficos Adreno.