El Foro de Evaluadores de IA ha publicado AEF-1, una propuesta de línea base para evaluaciones independientes de IA de terceros que cubren acceso, conflictos de interés, relaciones de financiación, recusación y transparencia. Este estándar surge junto a la propuesta de Dario Amodei para que las empresas de IA de vanguardia se comprometan a proporcionar acceso continuo, similar al de los empleados, a evaluadores de terceros integrados.
- AEF-1 establece requisitos de independencia, incluidas normas sobre conflictos de interés y financiación.
- Anthropic se compromete unilateralmente a brindar un acceso sin precedentes a sus equipos de seguridad, incluyendo escritorios en la oficina y herramientas internas.
- El debate más amplio incluye llamados a moderar el progreso frente a centrarse en el control y la contención.
- GitHub añadió niveles de selección automática de modelos a los flujos de trabajo de Copilot/Codex.
- Cline lanzó una aplicación nativa de escritorio para trabajar con modelos de peso abierto.
La publicación de AEF-1 señala un movimiento hacia la autorregulación formalizada y la verificación independiente dentro de la industria.