NVIDIA выпустила семейство моделей Nemotron-4 340B, включающее варианты Base, Instruct и Reward, а также конвейер генерации синтетических данных, использованный для выравнивания. Модели доступны открыто в рамках соглашения NVIDIA Open Model License Agreement и рассчитаны на размещение на одном DGX H100 с 8 GPU в точности FP8.

  • Варианты Nemotron-4-340B-Base, Instruct и Reward доступны по разрешительной лицензии, допускающей распространение и модификацию.
  • Модели демонстрируют конкурентоспособные результаты на открытых бенчмарках и были оптимизированы для размещения на одном DGX H100 с 8 GPU в точности FP8.
  • Более 98% данных, использованных в процессе выравнивания модели, было сгенерировано синтетически, что демонстрирует эффективность подхода.
  • NVIDIA открывает исходный код конвейера генерации синтетических данных для поддержки открытых исследований и облегчения обучения меньших языковых моделей.

Выпуск направлен на пользу сообществу в исследовательских работах и коммерческих приложениях, особенно для генерации синтетических данных при обучении меньших языковых моделей.