Proyek llama.cpp merilis build b11060, yang mencakup perbaikan untuk model Mamba agar memastikan input proyeksi langkah waktu bersifat kontigu. Perubahan ini mengatasi masalah tata letak memori dalam implementasi Mamba.
- Modul Mamba sekarang membuat input proyeksi langkah waktu menjadi kontigu untuk mencegah kesalahan.
- Optimasi selanjutnya melewatkan operasi salinan kontigu setelah normalisasi di jalur Mamba.
- Rilis ini menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, dan openEuler.
Pembaruan ini memastikan stabilitas untuk model berbasis Mamba sambil mempertahankan dukungan perangkat keras yang luas di ekosistem llama.cpp.