NVIDIA выпустила две модели с открытыми весами, d1-3B и d1-omni-600M, в рамках новой линейки моделей принятия решений d1. В отличие от генеративных моделей, которые создают токены, эти модели формируют ответы за один прямой проход, что обеспечивает крайне низкую задержку вывода на всем стеке NVIDIA — от дата-центров до периферийных устройств.

  • d1-3B набирает 48.57 балла на публичном сплите Decision Index v0.2.1, превосходя все модели объемом менее 10B и сравниваясь с Decider 35B-A3B при значительно меньшем размере.
  • d1-omni-600M — это экспериментальный чекпоинт, обрабатывающий текстовые, визуальные и аудиовходные данные, набравший 15.95 балла в том же индексе.
  • d1-3B достигает задержки вывода на уровне 8 мс на NVIDIA GeForce RTX 4090, 16 мс на Jetson AGX Thor и 26 мс на Jetson AGX Orin.
  • Обе модели поддерживают совместимость с llama.cpp «день в день» и работают на Apple M5 Pro, AMD MI325X и различных устройствах NVIDIA Jetson.

Эти модели с открытыми весами позволяют пользователям загружать, дообучать и развертывать быстрые возможности структурированного принятия решений для мультимодальных входных данных без ограничений.