Проект llama.cpp выпустил сборку b11001, которая включает критическое исправление функции `permute_transpose_impl`, обрабатывающей данные int16 на архитектурах RISC-V.
- Предыдущая версия неверно вызывала `rvv_transposed_s32_mn_to_nm` для 16-битных целых чисел, что приводило к повреждённым результатам транспонирования, где 14 из 16 позиций были неверными в матрице 4x4.
- Исправление заменяет ошибочный вызов на корректную функцию `rvv_transposed_s16_mn_to_nm`, которая уже была доступна и использовалась elsewhere в flash attention.
- Бинарные файлы предоставляются для macOS (Apple Silicon и Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), Android и openEuler.
Это обновление обеспечивает корректное транспонирование данных для операций int16 на оборудовании RISC-V, предотвращая ошибки вычислений в затронутых моделях.