Anthropic lance un programme de subventions de 5 millions de dollars pour financer des recherches indépendantes sur l'impact de l'IA sur le bien-être des utilisateurs. L'initiative fournit un financement direct, un accès aux modèles et un support technique aux bénéficiaires qui construisent des évaluations open-source aidant l'industrie à mesurer les effets des modèles sur le bien-être des utilisateurs.

  • Les bénéficiaires travaillent de manière totalement indépendante et publient des projets open-source pour l'utilisation des développeurs.
  • Les évaluations doivent clairement indiquer ce qu'elles mesurent et impliquer des experts cliniques dans la conception et la validation.
  • Les programmes doivent tester à la fois les précautions et les dommages, reflétant des conversations multi-tours où le risque s'intensifie.
  • Les candidatures sont ouvertes jusqu'au 21 septembre, avec des notifications complètes des propositions pour le 5 octobre.

En finançant des benchmarks indépendants, Anthropic vise à inviter cliniciens, psychologues et méthodologues à aider à développer des normes rigoureuses pour la sécurité de l'IA dans les contextes de soutien émotionnel.