Проект llama.cpp выпустил сборку b11298, которая добавляет поддержку формата dflash. Это обновление позволяет как конвертировать модели в этот формат, так и выполнять последующее извлечение признаков.

  • Инструмент конвертации моделей обновлен для работы с входными данными dflash.
  • Функциональность извлечения признаков теперь доступна для моделей dflash.
  • В процессе разработки была исправлена компонента 'cont'.
  • Бинарные файлы предоставлены для macOS, Linux, Windows, Android и openEuler для бэкендов CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) и NPU.

Это обновление позволяет пользователям использовать модели dflash в экосистеме llama.cpp.