OpenAI a publié trois nouveaux modèles—GPT-4.1, GPT-4.1 mini et GPT-4.1 nano—dans son API, offrant des capacités améliorées en matière de codage, de suivi des instructions et de contexte long par rapport à GPT-4o.

  • GPT-4.1 obtient 54,6 % sur SWE-bench Verified, soit une amélioration absolue de 21,4 % par rapport à GPT-4o, et établit un nouvel état de l'art sur Video-MME pour la compréhension multimodale de contexte long.
  • GPT-4.1 mini réduit la latence de près de moitié et le coût de 83 %, tout en égalant ou dépassant GPT-4o dans les évaluations d'intelligence.
  • GPT-4.1 nano est le modèle le plus rapide et le moins cher, obtenant 80,1 % sur MMLU et prenant en charge une fenêtre de contexte de 1 million de tokens.
  • Tous les modèles prennent en charge jusqu'à 1 million de tokens de contexte et disposent d'une date limite de connaissances de juin 2024.

Ces améliorations rendent la famille GPT-4.1 plus efficace pour construire des agents et gérer des tâches complexes telles que l'ingénierie logicielle et l'analyse de documents.