Seorang pengembang telah merilis paket GGUF lengkap untuk model NVIDIA Nemotron-3-Nano-Omni-30B, menambahkan dukungan audio dan video sebelumnya yang hilang ke ekosistem llama.cpp. Rilis ini mencakup sembilan kuantisasi mulai dari Q3_K_M hingga BF16 serta file proyektor terpadu yang menggabungkan encoder visi C-RADIO dan encoder audio Parakeet.
- Fork khusus llama.cpp mengimplementasikan grafik audio Parakeet/FastConformer dan grafik video C-RADIO, memungkinkan pemrosesan satu tahap untuk video beserta suaranya.
- Grafik video cocok dengan referensi PyTorch NVIDIA hingga kesalahan L2 relatif 0,0019 persen, sementara grafik audio mentranskripsi narasi uji kata demi kata.
- Binari CUDA 13 Linux arm64 yang sudah dibangun tersedia untuk perangkat keras seperti DGX Spark dan Jetson Thor.
Pembaruan ini memungkinkan pengguna menjalankan modalitas gambar, teks, audio, dan video secara bersamaan melalui satu instance llama-server pada perangkat keras yang kompatibel.