El Foro de Evaluadores de IA ha publicado AEF-1, una propuesta de línea base para evaluaciones independientes de IA de terceros que cubren acceso, conflictos de interés, relaciones de financiación, recusación y transparencia. Este estándar surge junto a la propuesta de Dario Amodei para que las empresas de IA de vanguardia se comprometan a proporcionar acceso continuo, similar al de los empleados, a evaluadores de terceros integrados.

  • AEF-1 establece requisitos de independencia, incluidas normas sobre conflictos de interés y financiación.
  • Anthropic se compromete unilateralmente a brindar un acceso sin precedentes a sus equipos de seguridad, incluyendo escritorios en la oficina y herramientas internas.
  • El debate más amplio incluye llamados a moderar el progreso frente a centrarse en el control y la contención.
  • GitHub añadió niveles de selección automática de modelos a los flujos de trabajo de Copilot/Codex.
  • Cline lanzó una aplicación nativa de escritorio para trabajar con modelos de peso abierto.

La publicación de AEF-1 señala un movimiento hacia la autorregulación formalizada y la verificación independiente dentro de la industria.