Проект llama.cpp выпустил сборку b10148, устраняющую проблемы с конфигурацией спекулятивного декодирования и логированием. Обновление гарантирует, что явные аргументы командной строки для черновых моделей имеют приоритет над автоматическим разрешением боковой модели.

  • Явные флаги --model-draft теперь отключают автоматическое разрешение боковой модели, позволяя ручной конфигурации CLI переопределять поведение по умолчанию.
  • Логика выбора боковой модели была обновлена для привязки к тегу основной модели, что обеспечивает точные совпадения или возврат к ближайшему квантованию.
  • Логи загрузки спекулятивных моделей были повышены с уровня trace до info, делая видимость контекста черновой модели и MTP согласованной с другими системными логами.

Эти изменения повышают надежность для пользователей, полагающихся на ручную спецификацию черновых моделей, и обеспечивают более четкое операционное логирование.