Anthropicは、AIがユーザーのウェルビーイングに与える影響に関する独立した研究を資金提供するための500万ドルの助成金プログラムを開始しています。このイニシアチブは、業界がモデルがユーザーの福祉に与える影響を測定するのに役立つオープンソースの評価を構築する受給者に対し、直接資金、モデルへのアクセス、技術サポートを提供します。

  • 受給者は完全に独立して作業し、開発者向けのオープンソースプロジェクトを公開します。
  • 評価は測定対象を明確に明記し、設計と検証に臨床専門家を巻き込む必要があります。
  • プログラムは予防措置と害の両方をテストする必要があり、リスクが増大するマルチターン会話を反映する必要があります。
  • 申請は9月21日まで、完全な提案通知は10月5日までにあります。

独立したベンチマークに資金を提供することで、Anthropicは臨床医、心理学者、方法論者を招き、感情サポートの文脈におけるAI安全性のための厳格な基準の開発を支援することを目指しています。