Проект llama.cpp выпустил версию b11132, добавив поддержку бэкбона черновиков Gemma 4 DSpark. Это обновление включает возможности конвертации GGUF и выполнения для полных механизмов внимания и SWA в черновиках Gemma 4, включая связанные выходные веса и метаданные бэкбона типа boolean.
- Добавлена поддержка dspark для моделей черновиков Gemma 4 с вариантами полного внимания и SWA.
- Реализовано извлечение функций черновика Gemma из метаданных через механизм dflash.
- Выпущены бинарные файлы для macOS (Apple Silicon и Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android и iOS.
Это обновление позволяет пользователям использовать модели Gemma 4 в экосистеме llama.cpp на широком спектре аппаратных платформ.