Le composant mtmd dans llama.cpp prend désormais en charge le format d'image WebP grâce à l'intégration avec ffmpeg.
- Permet le traitement des images WebP au sein du framework mtmd.
- S'appuie sur ffmpeg pour la fonctionnalité de décodage.
Le composant mtmd dans llama.cpp prend désormais en charge le format d'image WebP grâce à l'intégration avec ffmpeg.
Le projet llama.cpp a publié la compilation b10568, qui met à jour la gestion des modèles pour utiliser la fonction `ggml_rope_set_offset()`. Ce changement est partiellement appliqué pour prendre en charge DeepSeek 2.
Le projet llama.cpp a publié la version 0.2.0, qui inclut une synchronisation avec la bibliothèque ggml mise à jour vers la version 0.21.0. Cette mise à jour introduit plusieurs améliorations des backends et de nouvelles fonctionnalités sur diverses plateformes matérielles.
Le moteur Celestium a introduit plusieurs mises à jour pour améliorer les performances de SDXL sur du matériel à faible VRAM. Ces modifications se concentrent sur la gestion de la mémoire, la stabilité et les mécanismes de repli afin d'assurer une génération cohérente même sur des systèmes aux ressources limitées.
Le projet llama.cpp a publié la version b10549, qui introduit principalement le support du split de tenseurs dans les modèles LFM2 et LFM2MOE.
Le projet vLLM a publié la version 0.28.0rc2, qui inclut la fonction de décodage spéculatif DFlash2.
Nous utilisons des cookies pour mesurer l'audience et améliorer le site. Vous pouvez accepter ou refuser les cookies analytiques. Politique de confidentialité