github
llama.cpp
·
il y a 2 j
·
4 vues
llama.cpp b11238 ajoute ggml_pad_ext pour le remplissage à gauche et ignore les taps de DFlash2
Le projet llama.cpp a publié la version b11238, introduisant une implémentation unifiée du remplissage à gauche via la nouvelle fonction `ggml_pad_ext`. Ce changement consolide les méthodes précédentes utilisées par les encodeurs audio tels que Parakeet, LFM2-Audio, Granite Speech et Gemma 4, garantissant des embeddings bit-à-bit identiques pour Gemma 4 tout en simplifiant le support des backends.