Проект llama.cpp выпустил сборку b11298, которая добавляет поддержку формата dflash. Это обновление позволяет как конвертировать модели в этот формат, так и выполнять последующее извлечение признаков.
- Инструмент конвертации моделей обновлен для работы с входными данными dflash.
- Функциональность извлечения признаков теперь доступна для моделей dflash.
- В процессе разработки была исправлена компонента 'cont'.
- Бинарные файлы предоставлены для macOS, Linux, Windows, Android и openEuler для бэкендов CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) и NPU.
Это обновление позволяет пользователям использовать модели dflash в экосистеме llama.cpp.