Le projet llama.cpp a publié la version b10216, qui introduit un support complet pour GGML_OP_POOL_1D sur le backend Vulkan. Cette mise à jour inclut un nouveau shader de calcul reflétant l'implémentation existante de pool2d et corrige un plantage survenant lorsque les dimensions du tenseur entraînaient des limites finales négatives.
- Ajout de la structure vk_op_pool1d_push_constants et du champ pipeline_pool1d_f32 pour les opérations de pooling 1D.
- Implémentation du shader pool1d.compute pour gérer la logique de pooling 1D sur Vulkan.
- Correction de la logique du shader en enregistrant pool1d_f32 et en corrigeant les indices des dimensions du tenseur et l'échelle du pooling moyen.
- Résolution d'un problème de plantage de limite lorsque k0 < p0 et extension de la couverture de tests pour la correction.
Cette version permet aux utilisateurs d'utiliser des couches de pooling 1D dans les modèles accélérés par Vulkan, avec des binaires disponibles pour macOS, Linux, Windows, Android et openEuler sur CPU, CUDA, ROCm et autres backends.