OpenAI ha lanzado una vista previa de investigación de GPT-4.5, describiéndola como su modelo más grande y conocedor hasta la fecha. Construida sobre la arquitectura GPT-4o, la nueva escala el preentrenamiento aún más y está diseñada para ser más generalista que los modelos anteriores centrados en STEM.
La tarjeta del sistema describe varios aspectos clave del lanzamiento:
- El entrenamiento utiliza nuevas técnicas de supervisión combinadas con ajuste fino supervisado (SFT) y aprendizaje por refuerzo con retroalimentación humana (RLHF).
- Las pruebas tempranas indican una interacción más natural, una alineación más fuerte con la intención del usuario, inteligencia emocional mejorada y menos alucinaciones.
- Las evaluaciones de seguridad no encontraron un aumento significativo en el riesgo en comparación con los modelos existentes en categorías como CBRN, ciberseguridad, persuasión y autonomía del modelo.
OpenAI está compartiendo esta vista previa para comprender mejor las fortalezas y limitaciones del modelo mientras explora cómo los usuarios podrían utilizar sus capacidades.