Robotics
lab Google DeepMind Blog · 10 hari lalu · 4 tayangan

Google memperkenalkan Gemini Robotics 2 untuk kontrol seluruh tubuh dan kolaborasi multi-robot

Google telah memperkenalkan Gemini Robotics 2, lapisan kecerdasan yang dirancang untuk memberikan robot adaptif kontrol seluruh tubuh yang cerdas, ketangkasan canggih, dan kemampuan untuk berkolaborasi dalam tim. Pembaruan ini memperluas kemampuan AI fisik melampaui tugas-tugas sempit dan berulang dengan memungkinkan robot bernalar tentang gerakan dan beradaptasi dengan cepat ke tubuh baru.

lab Google DeepMind Blog · 10 hari lalu · 9 tayangan

Google meluncurkan Gemini Robotics ER 2 dengan pemahaman video dan kolaborasi multi-robot

Google telah meluncurkan Gemini Robotics ER 2, model penalaran berbadan baru yang dirancang untuk membantu robot berpikir cepat dan merencanakan tugas multi-langkah secara real-time. Pembaruan ini memperkenalkan peningkatan signifikan dibandingkan versi ER 1.6 sebelumnya, termasuk pelacakan kemajuan berbasis video secara berkelanjutan, pencarian momen presisi, dan kemampuan kolaborasi multi-robot asli.

lab Meta AI / FAIR Blog · 13 hari lalu · 3 tayangan

Universitas Pittsburgh menggunakan DINOv3 dan SAM dari Meta untuk robot asisten ARPA-H yang didanai RAMMP

Laboratorium Riset Teknik Manusia (HERL) Universitas Pittsburgh memimpin Platform Mobilitas dan Manipulasi Asisten Robotik yang Memberikan Kemandirian bagi Penyandang Disabilitas (RAMMP), sebuah proyek yang didukung hingga $41.5 juta pendanaan dari ARPA-H. Inisiatif ini bertujuan menciptakan solusi mobilitas asisten yang lebih aman dan adaptif bagi pengguna kursi roda dengan mengintegrasikan robotika canggih ke model visi AI sumber terbuka Meta.

lab Hugging Face Blog · 13 hari lalu · 19 tayangan

NVIDIA memperkenalkan Cosmos-H-Dreams, simulator generatif waktu nyata untuk robotika bedah

NVIDIA telah memperkenalkan Cosmos-H-Dreams, simulator generatif berbasis aksi dan waktu nyata untuk robotika bedah yang memadatkan kemampuan Cosmos-H-Surgical-Simulator-nya ke dalam model siswa kausal. Dilayani melalui perpustakaan inferensi streaming dipercepat FlashDreams dari NVIDIA, sistem ini memungkinkan kontrol interaktif oleh manusia atau kebijakan terlatih dalam loop tertutup.

lab Hugging Face Blog · 19 hari lalu · 8 tayangan

Gambaran umum mesin simulasi untuk AI Fisik: MuJoCo, Isaac Sim, dan Newton

Artikel ini memberikan gambaran umum tentang keadaan terkini simulasi untuk AI Fisik, menjelaskan bagaimana simulasi menjembatani kesenjangan data untuk robotika dengan memungkinkan lingkungan pelatihan yang skalabel dan fotorealistik. Artikel ini menguraikan paradigma tiga-komputer (pelatihan, simulasi, di-robot) dan mengategorikan mesin simulasi utama berdasarkan kemampuan dan kasus penggunaan spesifiknya.

media MarkTechPost · 19 hari lalu · 4 tayangan

NVIDIA merilis Cosmos 3 Edge, model dunia terbuka 4B untuk penalaran robot di perangkat

NVIDIA telah merilis Cosmos 3 Edge, sebuah model dunia terbuka dengan 4 miliar parameter yang dirancang untuk dijalankan secara on-device pada robot dan agen AI penglihatan. Dirilis pada 20 Juli di Hugging Face, model ini memungkinkan sistem memahami lingkungan, bernalar secara real-time, dan menghasilkan tindakan robot secara lokal tanpa ketergantungan pada cloud.

lab Hugging Face Blog · 19 hari lalu · 2 tayangan

Pollen Robotics merilis Grabette, sistem terbuka berbiaya rendah untuk merekam data manipulasi robot

Pollen Robotics telah merilis Grabette, perangkat genggam sumber terbuka yang dirancang untuk merekam data manipulasi robot dunia nyata tanpa memerlukan robot atau rig teleoperasi. Sistem ini menggunakan kamera fisheye dan kamera kedalaman RGBD untuk menangkap lintasan 6-DoF, memungkinkan pengguna menghasilkan dataset bersih yang dapat diproses melalui dasbor berbasis browser dan dibagikan di Hugging Face Hub.

lab Hugging Face Blog · 20 hari lalu · 1 tayangan

NVIDIA merilis Cosmos 3 Edge, model 4 miliar parameter untuk kontrol robot waktu nyata di perangkat tepi

NVIDIA telah merilis Cosmos 3 Edge, model dunia terbuka 4 miliar parameter yang dirancang untuk memberikan kinerja setara pusat data pada sistem tepi dengan keterbatasan memori. Model ini memungkinkan robot dan agen AI penglihatan memahami lingkungan mereka, bernalar secara waktu nyata, dan menghasilkan tindakan langsung di perangkat seperti modul NVIDIA Jetson.

arxiv arXiv cs.AI · 23 hari lalu SWE-bench Pro · 63.2%

Xiaomi merilis U0, model 38B-parameter untuk sintesis terpadu berbadan

Xiaomi telah memperkenalkan Xiaomi-Robotics-U0, model autoregresif multimodal dengan 38 miliar parameter yang dirancang untuk sintesis terpadu berbadan. Model ini memperlakukan generasi berbadan sebagai perluasan dari generasi gambar dan video dasar, mengoptimalkan secara bersama-sama generasi teks-ke-gambar, pengeditan gambar, generasi adegan berbadan, transfer berbadan, dan generasi video berbadan.

arxiv arXiv cs.AI · 27 hari lalu · 1 tayangan

Kerangka pasca-pelatihan PAC-ACT meningkatkan kebijakan ACT untuk manipulasi kontak presisi

Makalah ini memperkenalkan PAC-ACT, sebuah kerangka pasca-pelatihan pembelajaran penguatan yang dirancang untuk meningkatkan kebijakan Action Chunking Transformer (ACT) pra-pelatihan untuk tugas kontak presisi industri. Metode ini merumuskan ulang optimisasi kebijakan pada tingkat chunk dan memanfaatkan arsitektur actor-critic yang ditransfer dengan ACT serta kendala prior perilaku hibrida.