Dyna Robotics telah merilis Dyna-2, sebuah model aksi-dunia untuk manipulasi robot yang dilatih awal pada lebih dari satu juta jam video egosentris manusia. Perusahaan menunjukkan bahwa video manusia biasa dapat menggantikan data berlabel aksi dengan menetapkan hukum penskalaan dari 1.000 hingga 1.000.000 jam.
- Dyna-2 adalah model generatif yang menggunakan backbone video-diffusion yang secara bersamaan melakukan denoising pada video masa depan dan potongan aksi.
- Model ini menunjukkan hukum penskalaan pada data manusia yang mentransfer zero-shot ke tugas robot yang belum pernah dilihat di dua platform bimanual stasioner.
- Denoising gabungan video dan aksi mengungguli pelatihan hanya aksi, dengan video secara khusus membantu generalisasi lintas perwujudan.
- Pelatihan pasca pada 14 tugas menunjukkan skor dinormalisasi rata-rata meningkat dari 20% menjadi 53% saat data berskala hingga satu juta jam.
- Dyna-2 memenuhi kriteria produksi di 87% situs pelanggan yang belum pernah dilihat, dibandingkan dengan 46% untuk model Dyna-1 sebelumnya.
Penelitian menunjukkan bahwa prediksi video mendorong transfer ke data robot, memungkinkan sistem belajar dari sejumlah besar pengalaman manusia tanpa label alih-alih bergantung pada teleoperasi yang mahal.