Релиз llama.cpp b10361 устраняет критическую ошибку, при которой Sliding Window Attention (SWA) не была включена для модели LGAI-EXAONE 4.5 из-за неверного порядка параметров при загрузке.
- Загрузчик модели теперь корректно обрабатывает файлы GGUF EXAONE 4.5, исправляя порядок чтения `hparams.n_layer()` и `LLM_KV_NEXTN_PREDICT_LAYERS`, что обеспечивает правильную активацию SWA.
- Путь только для метаданных при построении моделей теперь пропускает тензоры, помеченные как `TENSOR_SKIP`, предотвращая сбои проверок из-за типов буферов null в архитектурах, использующих слои nextn/MTP.
- Были добавлены тесты для проверки порядка параметров hparams EXAONE 4, подтверждая, что исправление корректно устанавливает `swa_type` в STANDARD вместо NONE.
Это обновление гарантирует, что официальные релизы GGUF LGAI-EXAONE работают корректно с оконным вниманием и позволяет строить модели со слоями nextn/MTP через путь только для метаданных.