Gradio a publié Workflow1111, un projet qui reconstruit la plupart des fonctionnalités de stable-diffusion-webui d'AUTOMATIC1111 en utilisant le framework gr.Workflow. L'application se compose d'un seul canevas contenant onze pipelines multimédias construits à partir de soixante-treize nœuds, couvrant la génération d'images à partir de texte, la vidéo à partir d'images et diverses tâches de prétraitement.

  • Le workflow intègre des modèles SOTA pour la génération d'images à partir de texte, le fix haute résolution, l'image vers image, les grilles de matrice de prompts, l'interrogation VLM, les masques de détection vers inpainting, les annotateurs de type ControlNet, la suppression d'arrière-plan, le stockage des informations PNG et la vidéo à partir d'images.
  • Il utilise quatre types d'opérateurs : fn (fonctions Python), model (via InferenceClient), space (autres Gradio Spaces) et dataset (lignes du Hub).
  • Les utilisateurs peuvent exécuter les pipelines en se connectant avec un compte Hugging Face ou en fournissant un jeton d'accès, en utilisant leur propre quota pour les appels de modèle.
  • Le système expose chaque nœud de sortie en tant qu'endpoint REST et outil MCP, permettant aux assistants IA d'appeler les étapes de génération, de détection et de récupération de métadonnées.
  • Bien que les exécutions par défaut utilisent du matériel distant via Inference Providers, les nœuds fn peuvent également charger des points de contrôle locaux pour s'exécuter sur le GPU de l'utilisateur.

Cette approche permet aux utilisateurs de construire, partager et modifier des pipelines multimodèles complexes dans un navigateur sans écrire de code de liaison ni installer de dépendances.