Le projet llama.cpp a publié la version b11132, introduisant le support pour le backbone de brouillon Gemma 4 DSpark. Cette mise à jour active la conversion GGUF et les capacités d'exécution pour les brouillons Gemma 4 avec attention complète et SWA, y compris les poids de sortie liés et les métadonnées du backbone booléennes.
- Ajout du support dspark pour les modèles de brouillon Gemma 4 avec des variantes d'attention complète et SWA.
- Mise en œuvre de l'inférence des caractéristiques de brouillon Gemma à partir des métadonnées via le mécanisme dflash.
- Publication de binaires pour macOS (Apple Silicon et Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android et iOS.
Cette version permet aux utilisateurs d'utiliser les modèles Gemma 4 au sein de l'écosystème llama.cpp sur une large gamme de plateformes matérielles.