El proyecto llama.cpp lanzó la versión b11132, introduciendo soporte para el backbone de borrador Gemma 4 DSpark. Esta actualización habilita la conversión GGUF y capacidades en tiempo de ejecución para borradores Gemma 4 con atención completa y SWA, incluyendo pesos de salida vinculados y metadatos del backbone booleanos.
- Añadido soporte dspark para modelos de borrador Gemma 4 con variantes de atención completa y SWA.
- Implementada la inferencia de características de borrador Gemma desde metadatos a través del mecanismo dflash.
- Lanzados binarios para macOS (Apple Silicon e Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android e iOS.
Este lanzamiento permite a los usuarios utilizar modelos Gemma 4 dentro del ecosistema llama.cpp en una amplia gama de plataformas de hardware.