Le projet llama.cpp a publié la compilation b11298, qui introduit le support du format dflash. Cette mise à jour permet à la fois la conversion des modèles vers ce format et les capacités ultérieures d'extraction de fonctionnalités.
- L'outil de conversion de modèles a été mis à jour pour gérer les entrées dflash.
- La fonctionnalité d'extraction de fonctionnalités est désormais disponible pour les modèles dflash.
- Une correction a été appliquée au composant 'cont' lors du développement.
- Des binaires sont fournis pour macOS, Linux, Windows, Android et openEuler sur les backends CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) et NPU.
Cette version permet aux utilisateurs d'utiliser des modèles dflash au sein de l'écosystème llama.cpp.