O projeto llama.cpp lançou a compilação b11298, que introduz suporte ao formato dflash. Esta atualização permite tanto a conversão de modelos para este formato quanto a capacidade subsequente de extração de recursos.

  • A ferramenta de conversão de modelos foi atualizada para lidar com entradas dflash.
  • A funcionalidade de extração de recursos agora está disponível para modelos dflash.
  • Uma correção foi aplicada ao componente 'cont' durante o desenvolvimento.
  • Binários estão disponíveis para macOS, Linux, Windows, Android e openEuler nos backends de CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) e NPU.

Este lançamento permite que os usuários utilizem modelos dflash dentro do ecossistema llama.cpp.