Robotics
arxiv arXiv cs.AI · hace 13 d · 18 vistas

Show-Harness permite a agentes VLM controlar robots mediante una interfaz semántica compacta

Los autores presentan Show-Harness, un Harness Encarnado que permite a los modelos de visión y lenguaje (VLM) controlar robots a través de una interfaz semántica compacta que vincula la intención con la acción. Este sistema expone unidades de acción semánticas discretas para el razonamiento VLM y utiliza intérpretes específicos de la encarnación para anclarlos en acciones locales del robot.

media MarkTechPost · hace 30 d · 44 vistas

Generalist AI lanza GEN-1.5, un modelo base de robótica que aprende tareas a partir de una sola demostración

Generalist AI ha lanzado GEN-1.5, un modelo base de robótica orientado a la investigación capaz de aprender nuevas tareas de manipulación física a partir de una única demostración de 3–12 segundos mediante su ventana de contexto de 30 segundos. Esta capacidad, denominada "prompting físico", surgió espontáneamente tras más de ocho meses de preentrenamiento continuo en datos de interacción física, en lugar de haber sido diseñada explícitamente.