Предварительная версия Atria Dawn представляет собой базовую агентную языковую модель, предназначенную для научных исследований и инженерных рабочих процессов, обученную с помощью конвейера проверяемого опыта, который связывает опосредованные инструментами взаимодействия с исполняемыми средами. По 16 бенчмаркам, охватывающим реальные исследования, инженерию и цифровую работу, модель конкурентоспособна с передовыми агентами и достигает наивысшего зафиксированного результата в пяти из них.

  • Конвейер обучения связывает опосредованные инструментами взаимодействия с исполняемыми средами и внешне верифицируемыми результатами.
  • Анализ 769 записей задач от 56 участников показывает, что около трети завершённых задач с помощью ИИ были оценены как невыполнимые без ИИ.
  • Агенты часто предлагают методы и реализуют правки, тогда как люди сохраняют большинство окончательных решений и направляют исследование через суждение и обратную связь.

Авторы считают это значимым, поскольку это указывает на переход от выполнения задач к партнёрству на уровне проектов, где усилия человека сосредоточены на том, что стоит преследовать и как доказательства должны направлять исследования.