La version b10361 de llama.cpp corrige un bug critique où l'attention à fenêtre glissante (SWA) n'était pas activée pour le modèle LGAI-EXAONE 4.5 en raison d'un ordre incorrect des paramètres lors du chargement.
- Le chargeur de modèles gère désormais correctement les fichiers GGUF EXAONE 4.5 en corrigeant l'ordre dans lequel `hparams.n_layer()` et `LLM_KV_NEXTN_PREDICT_LAYERS` sont lus, garantissant que SWA est correctement activé.
- Le chemin uniquement pour les métadonnées utilisé pour construire les modèles ignore désormais les tenseurs marqués avec `TENSOR_SKIP`, empêchant les échecs d'assertion causés par des types de tampon nuls dans les architectures utilisant des couches nextn/MTP.
- Des tests ont été ajoutés pour couvrir l'ordre des hparams EXAONE 4, vérifiant que la correction définit correctement `swa_type` sur STANDARD au lieu de NONE.
Cette mise à jour garantit que les versions officielles GGUF LGAI-EXAONE fonctionnent correctement avec l'attention à fenêtre glissante et permet de construire des modèles avec des couches nextn/MTP via le chemin uniquement pour les métadonnées.