著者は、現代の自己ホスト型長期存続エージェントシステムを単に「カスタマイズされたアシスタント」や「メモリプラスペルソナ」と記述することは、もはや技術的に十分でないと主張しています。これらの古い枠組みは、複雑なランタイム動作を単純なスタイルと検索に還元し、継続性、由来、および権威の規律における重要な区別を無視しています。

  • 提案されたフレームワークは、ガバナンスされた実行表面内で候補生成と許容されるアクションを分離します。
  • 重要な原則の一つは、モデルの自信が行動の権威または許可に等しくないということです。
  • 40の異なるケースを持つtyped-recoveryベンチマークを使用した内部制限テストでは、ガバナンスされたレーンでゼロの誤った権威承認を示しました。
  • 著者は、状態の許容性、汚染防止、および回復規律に関する具体的なエンジニアリングの課題を特定しています。

この用語の変化が必要なのは、継続性とガバナンスがこれらのシステムがアクションを判断し実行する方法に実質的に影響を与えるためであり、生の流暢さよりもより厳格な技術的評価を必要とするからです。