Proyek llama.cpp merilis build b11001, yang mencakup perbaikan kritis untuk fungsi `permute_transpose_impl` yang menangani data int16 pada arsitektur RISC-V.
- Versi sebelumnya secara keliru memanggil `rvv_transposed_s32_mn_to_nm` untuk bilangan bulat 16-bit, menyebabkan hasil transpose yang korup di mana 14 dari 16 posisi salah dalam matriks 4x4.
- Perbaikan mengganti panggilan yang salah tersebut dengan fungsi `rvv_transposed_s16_mn_to_nm` yang benar, yang sudah tersedia dan digunakan di tempat lain dalam flash attention.
- Binari disediakan untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), Android, dan openEuler.
Pembaruan ini memastikan transpose data yang benar untuk operasi int16 pada perangkat keras RISC-V, mencegah kesalahan perhitungan pada model yang terdampak.