Anthropic 正在启动一项 500 万美元的资助计划,用于资助关于 AI 如何影响用户福祉的独立研究。该倡议为构建开源评估项目的受助者提供直接资金、模型访问权限和技术支持,帮助行业衡量模型对用户福利的影响。

  • 受助者完全独立工作,并发布供开发者使用的开源项目。
  • 评估必须明确说明其测量内容,并在设计和验证过程中纳入临床专家。
  • 项目必须测试预防措施和危害,反映风险升级的多轮对话。
  • 申请截止日期为 9 月 21 日,完整提案通知将于 10 月 5 日发布。

通过资助独立基准测试,Anthropic 旨在邀请临床医生、心理学家和方法学家帮助制定情感支持场景中 AI 安全的严格标准。