Anthropic запускает программу грантов на $5 млн для финансирования независимых исследований влияния ИИ на благополучие пользователей. Инициатива предоставляет прямое финансирование, доступ к моделям и техническую поддержку получателям грантов, разрабатывающим оценки с открытым исходным кодом, которые помогают отрасли измерять влияние моделей на благополучие пользователей.

  • Получатели грантов работают полностью независимо и публикуют проекты с открытым исходным кодом для использования разработчиками.
  • Оценки должны четко указывать, что они измеряют, и включать клинических экспертов в процесс проектирования и валидации.
  • Программы должны тестировать как меры предосторожности, так и вред, отражая многооборотные разговоры, где риск нарастает.
  • Заявки принимаются до 21 сентября, полные уведомления о предложениях будут направлены к 5 октября.

Финансируя независимые бенчмарки, Anthropic стремится привлечь клиницистов, психологов и методологов для разработки строгих стандартов безопасности ИИ в контексте эмоциональной поддержки.