NVIDIA ha lanzado la familia de modelos Nemotron-4 340B, que comprende variantes Base, Instruct y Reward, junto con la canalización de generación de datos sintéticos utilizada para el alineamiento. Los modelos son de acceso abierto bajo el Acuerdo de Licencia de Modelo Abierto de NVIDIA y están dimensionados para caber en un único DGX H100 con 8 GPUs en precisión FP8.
- Las variantes Nemotron-4-340B-Base, Instruct y Reward están disponibles bajo una licencia permisiva que permite la distribución y modificación.
- Los modelos compiten de manera competitiva contra benchmarks de acceso abierto y fueron optimizados para caber en un único DGX H100 con 8 GPUs en precisión FP8.
- Más del 98% de los datos utilizados en el proceso de alineamiento del modelo fueron generados sintéticamente, demostrando la efectividad del enfoque.
- NVIDIA está liberando como código abierto la canalización de generación de datos sintéticos para apoyar la investigación abierta y facilitar el entrenamiento de modelos de lenguaje más pequeños.
El lanzamiento tiene como objetivo beneficiar a la comunidad en estudios de investigación y aplicaciones comerciales, particularmente para generar datos sintéticos que entrenen modelos de lenguaje más pequeños.