OpenAI는 웹 브라우징, Python 실행 및 이미지 분석을 포함한 완전한 도구 사용을 최첨단 추론 능력과 결합한 o3 및 o4-mini 모델을 출시했습니다. 이 모델들은 복잡한 수학, 코딩 및 과학적 도전을 해결하는 능력을 향상시키기 위해 사고의 사슬(chains of thought)에서 대규모 강화 학습을 사용하여 훈련되었습니다.

  • 모델은 이미지 자르기 또는 Python을 통한 데이터 분석 등 능력을 보완하기 위해 사고 과정 내에서 도구를 활용합니다.
  • OpenAI의 Safety Advisory Group은 Preparedness Framework의 버전 2에 따라 모델을 검토했습니다.
  • 평가 결과, 어느 모델도 생물학적 및 화학적 능력, 사이버 보안 또는 AI 자기 개선에서 '높음' 임계값에 도달하지 않는 것으로 나타났습니다.

이번 출시는 업데이트된 프레임워크 하에서의 첫 번째 출시를 의미하며, 회사는 고급 추론이 숙고된 정렬(deliberative alignment)을 통해 안전성과 견고성을 개선할 수 있는 새로운 경로를 제공한다고 밝혔습니다.