El proyecto llama.cpp lanzó la versión b10216, que introduce soporte completo para GGML_OP_POOL_1D en el backend de Vulkan. Esta actualización incluye un nuevo shader de cálculo que refleja la implementación existente de pool2d y corrige un fallo que ocurría cuando las dimensiones del tensor resultaban en límites finales negativos.
- Se añadió la estructura vk_op_pool1d_push_constants y el campo pipeline_pool1d_f32 para operaciones de agrupamiento 1D.
- Se implementó el shader pool1d.compute para manejar la lógica de agrupamiento 1D en Vulkan.
- Se corrigió la lógica del shader registrando pool1d_f32 y corrigiendo los índices de las dimensiones del tensor y la escala del agrupamiento promedio.
- Se resolvió un problema de fallo de límite cuando k0 < p0 y se amplió la cobertura de pruebas para la corrección.
Esta versión permite a los usuarios utilizar capas de agrupamiento 1D en modelos acelerados por Vulkan, con binarios disponibles para macOS, Linux, Windows, Android y openEuler en CPU, CUDA, ROCm y otros backends.