Un diagnóstico utilizando la canalización de inferencia hardware-agnostic de Celestium demuestra que Stable Diffusion XL puede ejecutarse de forma estable en GPUs con baja VRAM (4GB, 6GB y 8GB) aprovechando la precisión FP16 adaptativa y la limpieza autónoma de memoria. El enfoque previene picos de fragmentación durante las canalizaciones multi-etapa y utiliza un modo CPU de emergencia para mantener la generación cuando se agota la VRAM de la GPU.
- SDXL Base + Refiner se ejecuta en GPUs de 8GB, mientras que solo se recomienda SDXL Base para tarjetas de 4GB.
- La precisión FP16 adaptativa reduce la carga de VRAM, y BuffaloCore redimensiona dinámicamente los tensores para evitar desbordamientos.
- RealESRGANx2 añade una sobrecarga mínima incluso en GPUs de 4GB, y el sistema requiere cero dependencias de nube o CUDA.
Este método permite ejecutar SDXL sin conexión y localmente sin interrupciones en hardware de consumo que normalmente tiene dificultades con los requisitos de memoria del modelo.