TypeSafe AI выпустила Jev, новый класс моделей «System One», предназначенных для производственных сред. Генеральный директор компании и соавтор статьи InstructGPT Диогу Алмейда утверждает, что современные передовые модели отдавали приоритет выравниванию и отказам вместо надежности, что приводило к таким проблемам, как галлюцинации и сycophancy.

  • Jev использует новую технику обучения под названием Обучение с подкреплением для калиброванных решений (RLCD), которая оптимизирует эпистемически честные вероятности, а не человеческую оценку обратной связи или программно проверяемые выходные данные.
  • Модель стремится «исчезнуть на заднем плане» программного обеспечения, работая так же надежно, как регулярные выражения в задачах использования компьютера, голосового управления и кодинга агентов.
  • TypeSafe AI планирует выпустить будущие модели, такие как ReasoningJev, фокусируясь на композируемом, программируемом ИИ для автоматизации вместо общих чат-ассистентов.

Этот подход решает проблему калибровки, присущую предыдущим методам обучения, позволяя Jev служить надежной основой для автоматизированных рабочих процессов и умных программных приложений.