Tema · Robotics
lab Microsoft Research Blog · há 7 d · 28 visualizações

Microsoft Research mostra que o descarregamento da inferência de IA física melhora o desempenho do robô e a vida útil da bateria

A Microsoft Research desafia a suposição de que a inferência de IA física deve ser executada exclusivamente nas GPUs onboard dos robôs, demonstrando que o descarregamento para infraestrutura de borda ou nuvem melhora significativamente as cargas de trabalho de manipulação móvel. Seu estudo sistemático das cargas de trabalho de robótica revela que depender do processamento onboard limita o desempenho, a vida útil da bateria e a escalabilidade.

arxiv arXiv cs.AI · há 7 d · 9 visualizações

Shanghai AI Lab lança o modelo de mundo físico InternW0 para interações eficientes no mundo real

O Shanghai AI Laboratory apresentou o InternW0, a primeira instância da série de modelos de mundo físico InternW, projetada para manter previsões acionáveis em ambientes dinâmicos. O modelo aprende conjuntamente a dinâmica visual futura e o controle contínuo de robôs usando uma arquitetura de vídeo-ação assimétrica com correspondência de fluxo.

lab Hugging Face Blog · há 7 d · 16 visualizações

NVIDIA Warp e MjWarp permitem simulação de robótica paralela acelerada por GPU

O MuJoCo Warp (MJWarp), construído sobre o NVIDIA Warp, permite que modelos compatíveis do MuJoCo sejam executados em escala de GPU, viabilizando o avanço de centenas ou milhares de mundos de simulação independentes em uma única chamada. Essa arquitetura desloca o foco da minimização de latência para um único ambiente para a melhoria da taxa de transferência agregada, o que favorece o aprendizado por reforço e a amostragem em larga escala.

arxiv arXiv cs.AI · há 21 d · 21 visualizações

Show-Harness permite que agentes VLM controlem robôs por meio de uma interface semântica compacta

Os autores apresentam o Show-Harness, um Harness Encarnado que permite que modelos de visão e linguagem (VLM) controlem robôs através de uma interface semântica compacta que vincula intenção a ação. Este sistema expõe unidades de ação semânticas discretas para o raciocínio VLM e utiliza interpretadores específicos da encarnação para ancorá-los em ações locais do robô.