NVIDIA a publié la famille de modèles Nemotron-4 340B, comprenant les variantes Base, Instruct et Reward, sous une licence ouverte permissive. Les modèles sont conçus pour tenir sur un seul DGX H100 avec 8 GPU en précision FP8 et ont été entraînés sur 9 billions de tokens.

  • Nemotron-4-340B-Instruct dépasse les modèles instruct comparables en matière de suivi des instructions et de capacités de chat.
  • Nemotron-4-340B-Reward atteint une précision maximale sur RewardBench, surpassant des modèles propriétaires tels que GPT-4o-0513 et Gemini 1.5 Pro-0514.
  • Plus de 98 % des données utilisées pour l'alignement du modèle ont été générées de manière synthétique.
  • NVIDIA open-source le pipeline de génération de données synthétiques, y compris les prompts et les outils de filtrage de qualité.

Cette publication vise à soutenir la recherche communautaire et les applications commerciales en fournissant des modèles et des outils de haute qualité pour générer des données d'entraînement synthétiques.