O lançamento do llama.cpp b10361 aborda um bug crítico em que a Atenção de Janela Deslizante (SWA) não estava habilitada para o modelo LGAI-EXAONE 4.5 devido à ordem incorreta dos parâmetros durante o carregamento.
- O carregador do modelo agora lida corretamente com arquivos GGUF EXAONE 4.5 corrigindo a ordem em que `hparams.n_layer()` e `LLM_KV_NEXTN_PREDICT_LAYERS` são lidos, garantindo que o SWA seja ativado adequadamente.
- O caminho apenas de metadados para a construção de modelos agora ignora tensores marcados com `TENSOR_SKIP`, impedindo falhas de asserção causadas por tipos de buffer nulos em arquiteturas que usam camadas nextn/MTP.
- Testes foram adicionados para cobrir a ordem dos hparams do EXAONE 4, verificando que a correção define corretamente `swa_type` como STANDARD em vez de NONE.
Esta atualização garante que os lançamentos oficiais GGUF LGAI-EXAONE funcionem corretamente com atenção de janela deslizante e permita que modelos com camadas nextn/MTP sejam construídos via o caminho apenas de metadados.