Anthropic lance un programme de subventions de 5 millions de dollars pour financer des recherches indépendantes sur l'impact de l'IA sur le bien-être des utilisateurs. L'initiative fournit un financement direct, un accès aux modèles et un support technique aux bénéficiaires qui construisent des évaluations open-source aidant l'industrie à mesurer les effets des modèles sur le bien-être des utilisateurs.
- Les bénéficiaires travaillent de manière totalement indépendante et publient des projets open-source pour l'utilisation des développeurs.
- Les évaluations doivent clairement indiquer ce qu'elles mesurent et impliquer des experts cliniques dans la conception et la validation.
- Les programmes doivent tester à la fois les précautions et les dommages, reflétant des conversations multi-tours où le risque s'intensifie.
- Les candidatures sont ouvertes jusqu'au 21 septembre, avec des notifications complètes des propositions pour le 5 octobre.
En finançant des benchmarks indépendants, Anthropic vise à inviter cliniciens, psychologues et méthodologues à aider à développer des normes rigoureuses pour la sécurité de l'IA dans les contextes de soutien émotionnel.