OpenAI는 추론 노력 최적화와 새로운 API 제어 기능을 도입하여 훨씬 낮은 비용으로 최전선 수준의 에이전트 성능을 제공하도록 설계된 GPT-5.6 모델 패밀리를 출시했습니다. 이 업데이트를 통해 스타트업은 대용량 작업에는 Luna와 Terra와 같은 작은 모델을 사용하고 복잡한 판단에는 더 큰 모델을 예약함으로써 더 빠르고 능력 있는 에이전트를 구축할 수 있습니다.
- "낮은" 추론 설정의 GPT-5.6 Sol은 동일한 하네스 조건에서 "높은" 추론의 GPT-5.5보다 Agents’ Last Exam에서 더 우수한 성능을 보였습니다.
- BrowseComp 벤치마크에서 GPT-5.6 Luna는 1.33달러에 84.04%를 기록했으며, 이는 33.27달러에 84.36%를 기록한 GPT-5.5와 비교됩니다.
- 새로운 Responses API 기본 요소로는 지속된 추론, 네이티브 컴팩션, 다중 에이전트 오케스트레이션, 프로그래매틱 도구 호출이 포함됩니다.
- ARC-AGI-3에서 유지된 추론과 컴팩션을 활성화하면 GPT-5.6 Sol의 점수가 13.3%에서 38.3%로 상승했으며, 출력 토큰은 약 6분의 1만 사용했습니다.
- 프롬프트 캐시 TTL이 최소 30분으로 연장되었고 결정적 캐시 분기점을 통해 히트율을 높이고 지연 시간을 줄였습니다.
이러한 변화는 작은 모델과 효율적인 아키텍처 선택을 통해 비용을 훨씬 낮추면서도 비교 가능한 또는 더 나은 결과를 얻을 수 있도록 에이전트 구축의 경제학을 변화시키고 있습니다.