NVIDIA ha lanzado la familia de modelos Nemotron-4 340B, que comprende variantes Base, Instruct y Reward, bajo una licencia abierta permisiva. Los modelos están diseñados para caber en un único DGX H100 con 8 GPUs en precisión FP8 y fueron entrenados con 9 billones de tokens.

  • Nemotron-4-340B-Instruct supera a modelos instruct comparables en seguimiento de instrucciones y capacidades de chat.
  • Nemotron-4-340B-Reward alcanza la máxima precisión en RewardBench, superando a modelos propietarios como GPT-4o-0513 y Gemini 1.5 Pro-0514.
  • Más del 98% de los datos utilizados para la alineación del modelo fueron generados sintéticamente.
  • NVIDIA abre el código fuente de la canalización de generación de datos sintéticos, incluyendo prompts y herramientas de filtrado de calidad.

El lanzamiento tiene como objetivo apoyar la investigación comunitaria y las aplicaciones comerciales proporcionando modelos y herramientas de alta calidad para generar datos de entrenamiento sintéticos.