Проект llama.cpp выпустил сборку b11238, внедрив унифицированную реализацию левого дополнения через новую функцию `ggml_pad_ext`. Это изменение объединяет предыдущие методы, используемые аудиоэнкодерами, такими как Parakeet, LFM2-Audio, Granite Speech и Gemma 4, обеспечивая битово идентичные эмбеддинги для Gemma 4 и одновременно упрощая поддержку бэкендов.

  • Узел `ggml_pad_ext` теперь обрабатывает левое дополнение за одну операцию, поскольку все бэкенды поддерживают это, заменяя сложную логику сворачивания или конкатенации с заполнением нулями.
  • Обновление включает оптимизацию для пропуска отводов DFlash2, которые читают только данные дополнения, так как значения на позиции block_size и далее равны нулю.
  • Предварительно собранные бинарные файлы доступны для macOS (Apple Silicon и Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Android, Windows и openEuler.

Этот релиз улучшает согласованность между различными архитектурами моделей за счёт стандартизации операций дополнения и предоставляет обновлённые бинарные файлы для широкого спектра аппаратных платформ.