NVIDIA a publié la famille de modèles Nemotron-4 340B, comprenant les variantes Base, Instruct et Reward, ainsi que le pipeline de génération de données synthétiques utilisé pour l'alignement. Les modèles sont accessibles librement sous l'accord de licence NVIDIA Open Model License Agreement et sont dimensionnés pour tenir sur un seul DGX H100 avec 8 GPU en précision FP8.
- Les variantes Nemotron-4-340B-Base, Instruct et Reward sont disponibles sous une licence permissive permettant la distribution et la modification.
- Les modèles affichent des performances compétitives par rapport aux benchmarks accessibles librement et ont été optimisés pour tenir sur un seul DGX H100 avec 8 GPU en précision FP8.
- Plus de 98 % des données utilisées dans le processus d'alignement du modèle ont été générées synthétiquement, démontrant l'efficacité de cette approche.
- NVIDIA open-source le pipeline de génération de données synthétiques pour soutenir la recherche ouverte et faciliter l'entraînement de modèles de langage plus petits.
Cette publication vise à bénéficier à la communauté dans les études de recherche et les applications commerciales, en particulier pour la génération de données synthétiques destinées à entraîner des modèles de langage plus petits.