OpenAI는 표준 처리보다 최대 14배 빠른 GPT-5.6 Sol 모델을 실행하는 새로운 서비스 계층인 Ultrafast의 미리 버전을 출시하고 있습니다. Cerebras 하드웨어로 구동되는 이 모드는 초당 최대 750개의 출력 토큰을 생성하며, 초기에는 OpenAI API를 통해 제공됩니다.
이 서비스는 실시간 지능이 중요한 시간 민감한 워크플로우를 대상으로 하며, 다음을 포함합니다:
- 중단 중 로그 분석을 위한 인시던트 대응 및 신뢰성.
- 변화하는 시장 신호 평가를 위한 금융 연구 및 보안.
- 대화 중단 없이 복잡한 문제를 해결하기 위한 고객 지원 및 음성.
- 개인화된 추천 및 체크아웃 지원과 같은 상거래 애플리케이션.
- 상호작용 가능한 작업 세션을 가능하게 하는 라이브 연구 및 실험.
OpenAI는 Ultrafast가 속도를 희생하지 않고도 요구가 까다로운 워크플로우에 최전선의 지능을 가져옴으로써 기업이 더 신속한 제품을 구축하고 더 빠른 결정을 내릴 수 있다고 말합니다.