NVIDIA는 제한 없는 오픈 라이선스 하에 Base, Instruct, Reward 변형을 포함하는 Nemotron-4 340B 모델 패밀리를 출시했습니다. 이 모델들은 FP8 정밀도로 8개의 GPU를 갖춘 단일 DGX H100에 적합하도록 설계되었으며, 9조 개의 토큰으로 학습되었습니다.
- Nemotron-4-340B-Instruct은 지시 따르기 및 채팅 기능에서 유사한 지시 모델들을 능가합니다.
- Nemotron-4-340B-Reward는 GPT-4o-0513 및 Gemini 1.5 Pro-0514와 같은 독점 모델을 압도하며 RewardBench에서 최고 정확도를 달성했습니다.
- 모델 정렬에 사용된 데이터의 98% 이상이 합성 생성되었습니다.
- NVIDIA는 프롬프트 및 품질 필터링 도구를 포함한 합성 데이터 생성 파이프라인을 오픈소스로 공개합니다.
이번 출시는 고품질 모델과 합성 학습 데이터 생성을 위한 도구를 제공함으로써 커뮤니티 연구와 상업적 응용을 지원하기 위한 것입니다.