Anthropic은 AI가 사용자의 웰빙에 미치는 영향을 연구하는 독립적인 연구를 자금 지원하기 위해 500만 달러의 보조금 프로그램을 출시하고 있습니다. 이 이니셔티브는 산업이 모델이 사용자 복지에 미치는 영향을 측정하는 데 도움이 되는 오픈소스 평가를 구축하는 수혜자에게 직접 자금, 모델 접근 권한 및 기술 지원을 제공합니다.
- 수혜자는 완전히 독립적으로 작업하며 개발자 사용을 위해 오픈소스 프로젝트를 게시합니다.
- 평가는 무엇을 측정하는지 명확히 명시해야 하며 설계와 검증에 임상 전문가를 참여시켜야 합니다.
- 프로그램은 예방 조치와 해악을 모두 테스트해야 하며, 위험이 증가하는 다중 턴 대화를 반영해야 합니다.
- 신청 마감일은 9월 21일이며, 완전한 제안서 통지는 10월 5일까지 있습니다.
독립적인 벤치마크에 자금 지원함으로써 Anthropic은 정서적 지원 맥락에서 AI 안전을 위한 엄격한 기준 개발을 돕기 위해 임상 의사, 심리학자 및 방법론자를 초대하는 것을 목표로 합니다.