NVIDIA는 베이스(Base), 지시(Instruct), 보상(Reward) 변형을 포함한 Nemotron-4 340B 모델 패밀리와 정렬에 사용된 합성 데이터 생성 파이프라인을 출시했습니다. 이 모델들은 NVIDIA 오픈 모델 라이선스 계약(NVIDIA Open Model License Agreement) 하에 공개 접근이 가능하며, FP8 정밀도로 8개의 GPU가 장착된 단일 DGX H100에 적합하도록 설계되었습니다.

  • Nemotron-4-340B-Base, Instruct, Reward 변형은 배포 및 수정을 허용하는 관대한 라이선스 하에 제공됩니다.
  • 이 모델들은 공개 접근 가능한 벤치마크에서 경쟁력 있는 성능을 보였으며, FP8 정밀도로 8개의 GPU가 장착된 단일 DGX H100에 적합하도록 최적화되었습니다.
  • 모델 정렬 과정에 사용된 데이터의 98% 이상이 합성 생성되었으며, 이는 해당 접근 방식의 효과를 입증합니다.
  • NVIDIA는 오픈 리서치를 지원하고 더 작은 언어 모델을 위한 학습을 촉진하기 위해 합성 데이터 생성 파이프라인을 오픈소스로 공개했습니다.

이번 출시는 특히 더 작은 언어 모델을 훈련하기 위한 합성 데이터 생성에 중점을 두어, 연구 연구 및 상업적 응용 분야에서 커뮤니티에 혜택을 제공하려는 목표를 가지고 있습니다.