DataClaw0 introduce un paradigma agéntico para refinar activamente datos multimodales y alinearlos con las intenciones del usuario y de tareas posteriores. Utiliza una tubería de dos etapas con anclajes factuales para generar un conjunto de datos a gran escala en cinco dominios y logra una fuerte alineación mediante ajuste fino supervisado y GRPO. Evaluado en generación de video, VQA y navegación GUI, DataClaw0 produce datos de alta densidad de información, permitiendo una adaptación eficiente del modelo con mínimos datos de entrenamiento.