TypeSafe AIは、生産環境向けに設計された新しいクラスの「System One」モデルであるJevをリリースした。同社のCEOでありInstructGPT論文の共著者であるDiogo Almeidaは、現在の最先端モデルが信頼性よりもアライメントと拒否を優先してきた結果、ハルシネーションや迎合主義といった問題が生じていると指摘している。

  • Jevは、補正された意思決定のための強化学習(RLCD)と呼ばれる新しい訓練手法を利用しており、人間の評価によるフィードバックやプログラムで検証可能な出力ではなく、認識論的に正直な確率を最適化する。
  • このモデルはソフトウェアの「背景に溶け込む」ことを目指し、コンピュータ操作、音声制御、コーディングエージェントなどのタスクにおいて、正規表現と同様の信頼性を持つように機能する。
  • TypeSafe AIは、汎用チャットアシスタントではなく自動化のためのコンポーザブルでプログラム可能なAIに焦点を当てた、将来のReasoningJevなどのモデルをリリースする計画である。

このアプローチは、以前の訓練方法に内在するキャリブレーションの問題に対処し、Jevが自動ワークフローやスマートソフトウェアアプリケーションの堅牢な基盤として機能できるようにする。