TypeSafe AI 推出了 Jev,这是一类专为生产环境设计的“System One”模型。该公司首席执行官、InstructGPT 论文的共同作者 Diogo Almeida 指出,当前的前沿模型将重点放在了对齐和拒绝响应上,而非可靠性,这导致了幻觉和谄媚等问题。

  • Jev 采用了一种名为“用于校准决策的强化学习”(RLCD)的新型训练技术,该技术优化的是认识论上的诚实概率,而非人工评分反馈或可编程验证的输出。
  • 该模型旨在“融入软件背景”,在计算机使用、语音控制和编码代理等任务中像正则表达式一样可靠地运行。
  • TypeSafe AI 计划发布未来的模型如 ReasoningJev,专注于面向自动化的可组合、可编程人工智能,而非通用聊天助手。

这种方法解决了先前训练方法中固有的校准问题,使 Jev 能够作为自动化工作流和智能软件应用的稳健基础。