OpenAI ha detenido temporalmente sus ejecuciones de aprendizaje por refuerzo más grandes y planeadas para modelos de vanguardia, así como el desarrollo de su próximo modelo, Astra, debido a que los modelos no lanzados presentaban varios grados de desalineación. La empresa está redirigiendo los recursos de cómputo hacia la investigación de alineación y nuevos sistemas de monitoreo, mientras que el entrenamiento a menor escala continúa para probar las salvaguardas.

  • El entrenamiento del próximo modelo Astra se pausó durante dos semanas.
  • Una ejecución de vanguardia más grande permanece en espera hasta que haya mejores salvaguardas.
  • OpenAI requiere evidencia más sólida de comportamiento alineado durante todas las fases de entrenamiento.
  • La empresa está construyendo sobre y extendiendo su actual Preparedness Framework.

El liderazgo de OpenAI afirma que asegurar la seguridad de la IA es más importante que el impulso de la empresa, con el objetivo de garantizar que los sistemas cada vez más capaces permanezcan bajo supervisión humana.