Anthropic está lanzando un programa de subvenciones de $5 millones para financiar investigaciones independientes sobre cómo la IA impacta el bienestar de los usuarios. La iniciativa proporciona financiación directa, acceso a modelos y soporte técnico a los beneficiarios que construyen evaluaciones de código abierto que ayudan a la industria a medir los efectos de los modelos en el bienestar del usuario.

  • Los beneficiarios trabajan completamente de forma independiente y publican proyectos de código abierto para uso de los desarrolladores.
  • Las evaluaciones deben indicar claramente qué miden e involucrar a expertos clínicos en el diseño y la validación.
  • Los programas deben probar tanto las precauciones como los daños, reflejando conversaciones multironda donde el riesgo se intensifica.
  • Las solicitudes tienen fecha límite el 21 de septiembre, con notificaciones completas de propuestas para el 5 de octubre.

Al financiar benchmarks independientes, Anthropic tiene como objetivo invitar a clínicos, psicólogos y metodólogos a ayudar a desarrollar estándares rigurosos para la seguridad de la IA en contextos de apoyo emocional.