회계사를 위한 AI 에이전트 회사인 Basis는 OpenAI의 GPT-6 Astra를 복잡한 50탭 세금 워크북 작업에서 GPT-5.6 Sol과 비교하여 평가했습니다. 테스트 결과, GPT-6 Astra가 절반의 시간 내에 작업을 완료하고 사용자 의도에 대한 더 깊은 이해를 보여주었습니다.
- GPT-5.6 Sol에 비해 GPT-6 Astra는 50탭 워크북을 완료하는 데 50% 더 적은 시간이 걸렸습니다.
- Basis는 더 나은 의도 인식을 통해 내부 평가 점수가 약 20% 향상되었음을 관찰했습니다.
- 모델은 캐시를 유지하면서 작업 난이도에 따라 추론 계산을 동적으로 조정합니다.
- GPT-6 Astra는 더 넓은 컨텍스트에서 기대치를 추론할 수 있어 명시적 규칙의 필요성을 줄입니다.
추론의 동적 조정은 비용과 응답 시간을 줄여 Basis 및 그 고객에게 장기 실행 작업을 더 경제적으로 만듭니다.