Le projet llama.cpp a publié la version b10604, introduisant le support du format de modèle Deepseek 4 (DSV4) ainsi que de nouveaux binaires précompilés pour macOS et iOS.
- Ajoute le support des tenseurs sm pour Deepseek 4 (DSV4) avec une granularité plus grossière pour les splits de têtes et des correctifs pour dspark.
- Active la sauvegarde des modèles pour DSV4 et permet à dflash de revenir sur des appareils spécifiques.
- Inclut la fonctionnalité de allreduce différé pour les experts partagés.
- Fournit des binaires pour Apple Silicon sous macOS, des XCFrameworks pour iOS, et des binaires mis à jour pour Linux, Windows, Android et openEuler via CPU, GPU et backends spécialisés.
Cette version permet aux utilisateurs d'exécuter des modèles Deepseek 4 en utilisant llama.cpp et fournit des builds natifs mis à jour pour les appareils Apple.