Le projet llama.cpp a publié la version b11001, qui inclut une correction critique pour la fonction `permute_transpose_impl` gérant les données int16 sur les architectures RISC-V.
- La version précédente appelait incorrectement `rvv_transposed_s32_mn_to_nm` pour les entiers 16 bits, entraînant des résultats de transposition corrompus où 14 positions sur 16 étaient erronées dans une matrice 4x4.
- La correction remplace l'appel erroné par la fonction correcte `rvv_transposed_s16_mn_to_nm`, qui était déjà disponible et utilisée ailleurs dans flash attention.
- Des binaires sont fournis pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), Android et openEuler.
Cette mise à jour garantit une transposition correcte des données pour les opérations int16 sur le matériel RISC-V, empêchant les erreurs de calcul dans les modèles concernés.