OpenAI는 이전 모델 라인을 단일한 적응형 아키텍처로 통합하여 작업의 복잡성에 따라 "사고 노력"을 조정할 수 있는 새로운 AI 시스템인 GPT-5를 공개했습니다. 이 시스템은 표준 쿼리용 빠른 gpt-5-main 모델과 복잡한 문제용 심층적인 gpt-5-thinking 모델 간에 전환하는 실시간 라우터를 활용합니다.
- GPT-5는 SWE-bench Verified에서 74.9점, Aider Polyglot에서 88점을 기록하며 o3 대비 코딩 오류율을 3분의 1로 줄였습니다.
- HealthBench Hard에서 46.2점, AIME 2025에서 94.6점을 획득했으며, 사실 기반 벤치마크에서 o3보다 약 6배 적은 환각을 생성합니다.
- 새로운 "Safe Completions" 시스템이 강력한 거부 응답을 대체하여 광범위한 레드 팀 테스트 후 안전 가이드라인 내에서 유용한 출력을 제공하도록 설계되었습니다.
- API는 gpt-5, gpt-5-mini, gpt-5-nano 세 가지 모델 크기와 272,000개의 입력 토큰 및 128,000개의 출력 토큰을 지원하는 컨텍스트 창을 도입했습니다.
- 접근 권한은 계층별로 제공되며, 무료 사용자는 GPT-5와 GPT-5-mini에 액세스할 수 있고, Pro 구독자는 더 강력한 GPT-5 Pro에 대한 접근 권한을 얻습니다.
OpenAI는 이러한 개선이 프로그래밍, 의료 및 작문 작업 전반에서 더 신뢰할 수 있고 정확한 응답을 제공하기 위한 것이라고 밝혔습니다. 롤아웃은 즉시 ChatGPT 사용자와 API 개발자를 대상으로 시작됩니다.