NVIDIA выпустила семейство моделей Nemotron-4 340B, включающее варианты Base, Instruct и Reward, а также конвейер генерации синтетических данных, использованный для выравнивания. Модели доступны открыто в рамках соглашения NVIDIA Open Model License Agreement и рассчитаны на размещение на одном DGX H100 с 8 GPU в точности FP8.
- Варианты Nemotron-4-340B-Base, Instruct и Reward доступны по разрешительной лицензии, допускающей распространение и модификацию.
- Модели демонстрируют конкурентоспособные результаты на открытых бенчмарках и были оптимизированы для размещения на одном DGX H100 с 8 GPU в точности FP8.
- Более 98% данных, использованных в процессе выравнивания модели, было сгенерировано синтетически, что демонстрирует эффективность подхода.
- NVIDIA открывает исходный код конвейера генерации синтетических данных для поддержки открытых исследований и облегчения обучения меньших языковых моделей.
Выпуск направлен на пользу сообществу в исследовательских работах и коммерческих приложениях, особенно для генерации синтетических данных при обучении меньших языковых моделей.