OpenAI는 시스템 효율성 개선과 재귀적 자기 최적화 기법에 힘입어 GPT-5.6 모델에 대한 상당한 가격 인하를 발표했습니다. 동사는 GPT-5.4 수준의 지능 비용이 4개월 동안 약 13배 감소했으며, GPT-5.6 Luna 가격은 80%, Terra 가격은 20% 절감되었다고 보고합니다.
- OpenAI는 Triton과 Gluon의 프로덕션 커널을 자율적으로 재작성하기 위해 GPT-5.6 Sol을 활용하여 엔드투엔드 서빙 비용을 20% 줄였습니다.
- 수백 건의 자동화된 실험을 통해 개선된 추론 디코딩은 토큰 생성 효율성을 15% 이상 향상시켰습니다.
- 지연된 탐색과 프롬프트 캐싱을 포함한 에이전트 하니스 최적화는 Codex와 같은 도구에 대한 반복적 컴퓨팅 비용을 줄였습니다.
- 새로운 "Sol Fast" 티어는 표준 가격의 두 배로 2.5배 낮은 지연 시간을 제공하며, 다운스트림 에이전트 워크플로는 약 10배 낮은 비용을 보일 것으로 예상됩니다.
이러한 변화는 파인튜닝되지 않은 지능에 대해 OpenAI를 매우 비용 효율적인 위치로 자리매김하게 했으며, 관측자들은 3월의 플래그십 성능이 이제 이전 토큰 가격의 극히 일부로 제공된다고 지적했습니다.