NVIDIA telah merilis keluarga model Nemotron-4 340B, yang mencakup varian Base, Instruct, dan Reward, bersama dengan pipa generasi data sintetis yang digunakan untuk penyesuaian. Model-model ini dapat diakses secara terbuka di bawah Perjanjian Lisensi Model Terbuka NVIDIA dan dirancang agar muat pada satu DGX H100 dengan 8 GPU dalam presisi FP8.
- Varian Nemotron-4-340B-Base, Instruct, dan Reward tersedia di bawah lisensi permisif yang memungkinkan distribusi dan modifikasi.
- Model-model ini menunjukkan kinerja kompetitif terhadap benchmark akses terbuka dan dioptimalkan agar muat pada satu DGX H100 dengan 8 GPU dalam presisi FP8.
- Lebih dari 98% data yang digunakan dalam proses penyesuaian model dihasilkan secara sintetis, menunjukkan efektivitas pendekatan tersebut.
- NVIDIA membuka sumber pipa generasi data sintetis untuk mendukung penelitian terbuka dan memfasilitasi pelatihan model bahasa yang lebih kecil.
Rilis ini bertujuan untuk memberi manfaat bagi komunitas dalam studi penelitian dan aplikasi komersial, khususnya untuk menghasilkan data sintetis guna melatih model bahasa yang lebih kecil.