Robotics
arxiv arXiv cs.AI · il y a 13 j · 18 vues

Show-Harness permet aux agents VLM de contrôler des robots via une interface sémantique compacte

Les auteurs présentent Show-Harness, un Harness Incarné qui permet aux modèles de vision et de langage (VLM) de contrôler des robots via une interface sémantique compacte reliant l'intention à l'action. Ce système expose des unités d'action sémantiques discrètes pour le raisonnement VLM et utilise des interprètes spécifiques à l'incarnation pour les ancrer dans les actions locales du robot.

media MarkTechPost · il y a 30 j · 44 vues

Generalist AI publie GEN-1.5, un modèle fondamental pour la robotique apprenant des tâches à partir d'une seule démonstration

Generalist AI a publié GEN-1.5, un modèle fondamental de robotique orienté recherche capable d'apprendre de nouvelles tâches de manipulation physique à partir d'une seule démonstration de 3 à 12 secondes via sa fenêtre de contexte de 30 secondes. Cette capacité, appelée « physical prompting », est apparue spontanément après plus de huit mois de pré-entraînement continu sur des données d'interaction physique plutôt que d'être explicitement conçue.