GPT-5.6에 대한 두 가지 특정 API 설정을 활성화한 결과, ARC-AGI-3 벤치마크에서 성능 점수가 3배로 증가했습니다.
추론 능력을 유지하고 컴팩션(압축)을 활성화하여 개선되었으며, 이는 효율성도 높였습니다.
GPT-5.6에 대한 두 가지 특정 API 설정을 활성화한 결과, ARC-AGI-3 벤치마크에서 성능 점수가 3배로 증가했습니다.
추론 능력을 유지하고 컴팩션(압축)을 활성화하여 개선되었으며, 이는 효율성도 높였습니다.
GPT-5.1 출시 4주 후, OpenAI는 전문 지식 작업을 위해 설계된 새로운 모델 시리즈인 GPT-5.2를 출시했으며, 이는 여러 주요 벤치마크에서 Google의 Gemini 3 Pro와 동등하거나 그 이상의 성능을 발휘합니다.
오픈에이아이는 GPT-4.5를 연구용 미리보기로 출시했으며, 이를 동종 업계에서 가장 크고 우수한 채팅 모델이라고 설명했습니다. 이 모델은 초기에 차트GPT 프로 사용자와 개발자에게 제공되며, 다음 주부터 플러스 및 팀 사용자에게도 접근 권한이 확대됩니다.
OpenAI는 가장 고급 AI 모델에 대한 무료 액세스를 학술 연구자 10만 명에게 제공하고 있습니다. 이 이니셔티브는 학술 커뮤니티 내 과학 연구, 협력 및 발견을 가속화하는 것을 목표로 합니다.
DeepSWE 벤치마크에서의 Kimi K3와 GPT-5.6 Sol 비교 결과, GPT-5.6 Sol이 단일 추론 품질(72.7% 대 68.5%)에서 앞섰지만, Kimi K3는 훨씬 낮은 비용으로 k > 1에 대해 더 높은 pass@k 점수를 달성했습니다.
ChatGPT가 미국 내 자격 있는 사용자가 의료 기록과 Apple Health 데이터를 안전하게 연결할 수 있는 새로운 건강 기능을 출시했습니다.