NVIDIA telah merilis dua artefak sumber terbuka yang dirancang untuk membangun agen AI yang selalu aktif: model Nemotron 3.5 Lightning dan perpustakaan routing NeMo Switchyard. Alat-alat ini mengatasi biaya tinggi dan latensi dari pengiriman setiap langkah dalam alur kerja agen jangka panjang ke model penalaran terdepan dengan menyediakan kemampuan eksekusi dan routing khusus.

Nemotron 3.5 Lightning adalah model mixture-of-experts berukuran 30B dengan 3B parameter aktif, yang menampilkan arsitektur hibrida Mamba-2 + MoE + Attention dan jendela konteks 1M-token. Model ini mencapai kecepatan output hingga 4x lebih cepat dibandingkan model seukuran serupa dan menyelesaikan tugas PinchBench 30% lebih cepat daripada Qwen3.6 35B dengan akurasi yang sebanding.

NeMo Switchyard adalah perpustakaan sumber terbuka yang mengarahkan langkah-langkah alur kerja agen ke model paling mampu dan efisien yang tersedia, menawarkan router tanpa penyetelan seperti routing eskalasi dan tahap. Dalam benchmark, alat ini memangkas biaya sebesar 74% dalam pengujian LangChain dengan hanya mengirimkan 7% panggilan ke model terdepan, dengan Cognition melaporkan biaya rata-rata yang lebih rendah untuk Devin Desktop.

Kedua artefak tersedia secara umum di bawah lisensi permisif, dengan bobot Lightning dapat diakses di Hugging Face dan ModelScope, memungkinkan deployment pada GPU tunggal seperti DGX Spark atau H100.