OpenAI在其API中发布了三款新模型——GPT-4.1、GPT-4.1 mini和GPT-4.1 nano,与GPT-4o相比,它们在编码、指令遵循和长上下文能力方面有所提升。

  • GPT-4.1在SWE-bench Verified上得分54.6%,较GPT-4o绝对提升了21.4%,并在多模态长上下文理解的Video-MME基准上创下新的最先进水平。
  • GPT-4.1 mini将延迟降低近一半,成本降低83%,同时在智能评估中达到或超越GPT-4o的水平。
  • GPT-4.1 nano是最快且最便宜的模型,在MMLU上得分80.1%,并支持100万token的上下文窗口。
  • 所有模型均支持高达100万token的上下文,并具有截至2024年6月的知识截止日期。

这些改进使GPT-4.1系列在构建智能体和处理软件工程及文档分析等复杂任务方面更加高效。