Проект llama.cpp выпустил версию b11132, добавив поддержку бэкбона черновиков Gemma 4 DSpark. Это обновление включает возможности конвертации GGUF и выполнения для полных механизмов внимания и SWA в черновиках Gemma 4, включая связанные выходные веса и метаданные бэкбона типа boolean.

  • Добавлена поддержка dspark для моделей черновиков Gemma 4 с вариантами полного внимания и SWA.
  • Реализовано извлечение функций черновика Gemma из метаданных через механизм dflash.
  • Выпущены бинарные файлы для macOS (Apple Silicon и Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android и iOS.

Это обновление позволяет пользователям использовать модели Gemma 4 в экосистеме llama.cpp на широком спектре аппаратных платформ.