Anthropic está lanzando un programa de subvenciones de $5 millones para financiar investigaciones independientes sobre cómo la IA impacta el bienestar de los usuarios. La iniciativa proporciona financiación directa, acceso a modelos y soporte técnico a los beneficiarios que construyen evaluaciones de código abierto que ayudan a la industria a medir los efectos de los modelos en el bienestar del usuario.
- Los beneficiarios trabajan completamente de forma independiente y publican proyectos de código abierto para uso de los desarrolladores.
- Las evaluaciones deben indicar claramente qué miden e involucrar a expertos clínicos en el diseño y la validación.
- Los programas deben probar tanto las precauciones como los daños, reflejando conversaciones multironda donde el riesgo se intensifica.
- Las solicitudes tienen fecha límite el 21 de septiembre, con notificaciones completas de propuestas para el 5 de octubre.
Al financiar benchmarks independientes, Anthropic tiene como objetivo invitar a clínicos, psicólogos y metodólogos a ayudar a desarrollar estándares rigurosos para la seguridad de la IA en contextos de apoyo emocional.