A NVIDIA lançou a família de modelos Nemotron-4 340B, composta pelas variantes Base, Instruct e Reward, juntamente com o pipeline de geração de dados sintéticos utilizado para alinhamento. Os modelos estão disponíveis sob a Licença de Modelo Aberto da NVIDIA e são dimensionados para caber em um único DGX H100 com 8 GPUs em precisão FP8.
- As variantes Nemotron-4-340B-Base, Instruct e Reward estão disponíveis sob uma licença permissiva que permite distribuição e modificação.
- Os modelos apresentam desempenho competitivo contra benchmarks de acesso aberto e foram otimizados para caber em um único DGX H100 com 8 GPUs em precisão FP8.
- Mais de 98% dos dados utilizados no processo de alinhamento do modelo foram gerados sinteticamente, demonstrando a eficácia da abordagem.
- A NVIDIA está disponibilizando como código aberto o pipeline de geração de dados sintéticos para apoiar pesquisas abertas e facilitar o treinamento de modelos de linguagem menores.
O lançamento visa beneficiar a comunidade em estudos de pesquisa e aplicações comerciais, particularmente na geração de dados sintéticos para treinar modelos de linguagem menores.