A NVIDIA lançou a família de modelos Nemotron-4 340B, compreendendo variantes Base, Instruct e Reward, sob uma licença aberta permissiva. Os modelos são projetados para caber em um único DGX H100 com 8 GPUs em precisão FP8 e foram treinados em 9 trilhões de tokens.

  • Nemotron-4-340B-Instruct supera modelos instrucionais comparáveis em capacidade de seguir instruções e conversação.
  • Nemotron-4-340B-Reward alcança a maior precisão no RewardBench, superando modelos proprietários como GPT-4o-0513 e Gemini 1.5 Pro-0514.
  • Mais de 98% dos dados usados para alinhamento do modelo foram gerados sinteticamente.
  • A NVIDIA está disponibilizando em código aberto o pipeline de geração de dados sintéticos, incluindo prompts e ferramentas de filtragem de qualidade.

O lançamento visa apoiar a pesquisa da comunidade e aplicações comerciais, fornecendo modelos e ferramentas de alta qualidade para gerar dados de treinamento sintéticos.