Gradio ha lanzado Workflow1111, un proyecto que reconstruye la mayoría del conjunto de funciones de stable-diffusion-webui de AUTOMATIC1111 utilizando el framework gr.Workflow. La aplicación consiste en un único lienzo que contiene once pipelines multimedia construidos a partir de setenta y tres nodos, cubriendo tareas de texto a imagen, imagen a video y varias tareas de preprocesamiento.
- El workflow integra modelos SOTA para texto a imagen, corrección de alta resolución, imagen a imagen, cuadrículas de prompt-matrix, interrogación VLM, máscaras de detección a inpainting, anotadores estilo ControlNet, eliminación de fondo, almacenamiento de PNG Info y video a partir de imagen.
- Utiliza cuatro tipos de operadores: fn (funciones de Python), model (vía InferenceClient), space (otros Gradio Spaces) y dataset (filas de Hub).
- Los usuarios pueden ejecutar los pipelines iniciando sesión con una cuenta de Hugging Face o proporcionando un token de acceso, utilizando su propia cuota para las llamadas a modelos.
- El sistema expone cada nodo de salida como un punto final REST y herramienta MCP, permitiendo que los asistentes de IA llamen a pasos de generación, detección y recuperación de metadatos.
- Mientras que las ejecuciones por defecto utilizan hardware remoto a través de Inference Providers, los nodos fn también pueden cargar checkpoints locales para ejecutarse en la GPU propia del usuario.
Este enfoque permite a los usuarios construir, compartir y modificar pipelines complejos de múltiples modelos en un navegador sin escribir código de unión ni instalar dependencias.