Джейсон Ван Фам и соинженер Grok (xAI) опубликовали диагностический отчёт, описывающий режим отказа, близкий к «ванильному», в многошаговом сценарии на платформе Hydrodynamic Swarm при использовании пользовательского пути инструкций Gemma 4. Исследование показывает, что сочетание жадного декодирования с большим бюджетом токенов и буквенными ограничениями вызывает классическую деградацию текста, включая повторения и орфографический шум.
- Использовалась конфигурация с жадным декодированием (temperature = 0) с лимитом max_tokens в 300 и отключённым остаточным физическим управлением (force_cap = 0).
- Первоначальный связный вывод на английском языке превратился в повторяющиеся циклы и мусор из смешанных скриптов после того, как модель попыталась удовлетворить буквенное ограничение.
- Последующий метадиагностический шаг дал правдоподобный самоотчёт, прежде чем снова войти в то же деградационное аттракторное состояние.
- Авторы объясняют отказ сочетанием многошаговой истории, жадного декодирования и жёстких ограничений, а не ошибками загрузки весов или остаточным физическим вмешательством.
Этот отчёт служит публичным диагностическим артефактом, чтобы подчеркнуть, как несовершенные результаты и инженерные проблемы в пользовательских загрузчиках должны документироваться наряду с успешными демонстрациями.