"Alien Mind"というタイトルのエッセイで、OpenAIは推論言語モデルの急速な進展と再帰的自己改善の可能性について議論している。著者は、機械知能が設計されたアルゴリズムではなく、主に計算リソースのスケーリングによって駆動されながら、変革的な方法で人間の能力を超えつつあることへの懸念を表している。
- 推論モデルはコンピュータの操作、人間との協業、研究の実施においてますます高度な能力を示している。
- 目標指向強化学習や価値アライメントなどの現在の整列手法は、システムが複雑になるにつれて一般化において課題に直面している。
- チェイン・オブ・スート監視は、モデルが推論とツール使用を融合させ、自身の思考プロセスを操作する能力を高めるにつれて、効果が低下しつつある。
- OpenAIは整列のための技術的解決策を探求する予定であり、必要に応じて単独でさらなるスケール拡大を見送る可能性がある。
記事は、現在のAI開発の軌道が社会が対処する準備をしていない重大なリスクをもたらしているため、技術的な修正だけでなくより広範な介入が必要であると主張している。