Mid-Harness повышает надёжность действий терминального агента за счёт масштабирования вычислений во время тестирования
Исследователи представляют Mid-Harness — метод, который выбирает и проверяет кандидаты на действия на границе между моделью и оболочкой (harness), чтобы повысить надёжность выполнения в терминальных агентах. Этот подход распределяет вычисления во время тестирования за счёт проверки нескольких вариантов перед отправкой одного из них на выполнение, оставляя генератор и оболочку без изменений.