TypeSafe AI는 프로덕션 환경을 위해 설계된 새로운 클래스의 "System One" 모델인 Jev를 출시했습니다. 동사의 CEO이자 InstructGPT 논문의 공동 저자인 Diogo Almeida는 현재 최전방 모델들이 신뢰성보다 정렬과 거부 반응에 우선순위를 두어 환각 현상과 아부 같은 문제를 초래했다고 주장합니다.
- Jev는 RLCD(Reinforcement Learning for Calibrated Decisions)라는 새로운 훈련 기법을 활용하여, 인간이 평가한 피드백이나 프로그래밍적으로 검증 가능한 출력 대신 인식론적으로 정직한 확률을 최적화합니다.
- 이 모델은 컴퓨터 사용, 음성 제어, 코딩 에이전트와 같은 작업에서 정규식처럼 신뢰성 있게 작동하며 소프트웨어의 "배경으로 사라지는" 것을 목표로 합니다.
- TypeSafe AI는 범용 채팅 어시스턴트가 아닌 자동화를 위한 조합 가능하고 프로그래밍 가능한 AI에 중점을 둔 ReasoningJev와 같은 향후 모델들을 출시할 계획입니다.
이 접근 방식은 이전 훈련 방법의 본질적인 교정 문제를 해결하여, Jev가 자동화된 워크플로우와 스마트 소프트웨어 애플리케이션을 위한 견고한 기반 역할을 할 수 있게 합니다.