Proyek llama.cpp merilis build b11039, yang memperbarui model-saver untuk menulis pola perhatian jendela geser (SWA) dan geometri MLA SWA untuk semua model yang menggunakan SWA. Perubahan ini memastikan bahwa `sliding_window_pattern` ditulis sebagai flag per-layer daripada dikompresi menjadi skalar, sehingga mempertahankan representasi data yang tepat.
- Loader kini membaca pola SWA baik sebagai periode maupun array per-layer melalui `llama_model_base::load_swa_pattern()`, memperbaiki pengabaian diam terhadap array dalam konverter untuk olmo2, gemma3n, dan exaone4.
- model-saver menulis panjang kunci/nilai MLA dan peringkat KV LoRA untuk layer SWA, yang diperlukan oleh dots3note.
- Ini mengaktifkan saver untuk plamo3, gemma3, cohere2, cohere2moe, olmo2, exone-moe, afmoe, mimo2, spark2_5, muse-glimmer, mellum, laguna, granite_swa, dots3note, dan maple.
- Semua model yang terdaftar lolos dari uji roundtrip bit-exact test-llama-archs.
Pembaruan ini memastikan bahwa file GGUF yang dihasilkan oleh llama.cpp sesuai dengan konfigurasi SWA yang dimaksud tanpa mengubah output untuk file yang diterbitkan sebelumnya yang mengandalkan periode default.