O projeto llama.cpp lançou a versão b10216, que introduz suporte completo para GGML_OP_POOL_1D no backend Vulkan. Esta atualização inclui um novo shader de computação que espelha a implementação existente de pool2d e corrige uma falha que ocorria quando as dimensões do tensor resultavam em limites finais negativos.
- Adicionado vk_op_pool1d_push_constants struct e campo pipeline_pool1d_f32 para operações de pooling 1D.
- Implementado shader pool1d.compute para lidar com a lógica de pooling 1D no Vulkan.
- Corrigida a lógica do shader registrando pool1d_f32 e corrigindo os índices das dimensões do tensor e a escala do pooling médio.
- Resolvido um problema de falha de limite quando k0 < p0 e expandida a cobertura de testes para a correção.
Este lançamento permite que os usuários utilizem camadas de pooling 1D em modelos acelerados por Vulkan, com binários disponíveis para macOS, Linux, Windows, Android e openEuler em CPU, CUDA, ROCm e outros backends.