NVIDIAは、新しいd1意思決定モデルファミリーの一環として、2つのオープンウェイトモデルであるd1-3Bとd1-omni-600Mをリリースした。トークンを生成する生成モデルとは異なり、これらのモデルは単一の順伝播で回答を生成し、データセンターからエッジデバイスに至るNVIDIAのフルスタック全体で極めて低遅延の推論を可能にする。
- d1-3BはDecision Index v0.2.1のパブリックスプリットで48.57のスコアを獲得し、10B未満のすべてのモデルを上回り、サイズの数分の一でDecider 35B-A3Bと同等の性能を発揮する。
- d1-omni-600Mはテキスト、画像、音声の入力を処理する実験的なチェックポイントであり、同じインデックスで15.95のスコアを獲得した。
- d1-3BはNVIDIA GeForce RTX 4090で8 ms、Jetson AGX Thorで16 ms、Jetson AGX Orinで26 msの推論遅延を実現する。
- 両モデルともllama.cppとのday-one互換性をサポートし、Apple M5 Pro、AMD MI325X、および各種NVIDIA Jetsonデバイス上で動作する。
これらのオープンウェイトモデルにより、ユーザーは制限なくマルチモーダル入力に対する高速で構造化された意思決定能力をダウンロード、ファインチューニング、デプロイできる。