O projeto llama.cpp lançou a compilação b11298, que introduz suporte ao formato dflash. Esta atualização permite tanto a conversão de modelos para este formato quanto a capacidade subsequente de extração de recursos.
- A ferramenta de conversão de modelos foi atualizada para lidar com entradas dflash.
- A funcionalidade de extração de recursos agora está disponível para modelos dflash.
- Uma correção foi aplicada ao componente 'cont' durante o desenvolvimento.
- Binários estão disponíveis para macOS, Linux, Windows, Android e openEuler nos backends de CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) e NPU.
Este lançamento permite que os usuários utilizem modelos dflash dentro do ecossistema llama.cpp.