OpenAI ha lanzado tres nuevos modelos —GPT-4.1, GPT-4.1 mini y GPT-4.1 nano— en su API, con mejoras en codificación, seguimiento de instrucciones y capacidades de contexto largo en comparación con GPT-4o.

  • GPT-4.1 obtiene 54.6% en SWE-bench Verified, una mejora absoluta del 21.4% sobre GPT-4o, y establece un nuevo estado del arte en Video-MME para comprensión multimodal de contexto largo.
  • GPT-4.1 mini reduce la latencia casi a la mitad y el costo un 83%, mientras iguala o supera a GPT-4o en evaluaciones de inteligencia.
  • GPT-4.1 nano es el modelo más rápido y económico, obteniendo 80.1% en MMLU y soportando una ventana de contexto de 1 millón de tokens.
  • Todos los modelos soportan hasta 1 millón de tokens de contexto y tienen un corte de conocimiento de junio de 2024.

Estas mejoras hacen que la familia GPT-4.1 sea más efectiva para construir agentes y manejar tareas complejas como ingeniería de software y análisis de documentos.