Диагностика с использованием аппаратно-независимого конвейера вывода Celestium показывает, что Stable Diffusion XL может стабильно работать на GPU с малым объёмом VRAM (4 ГБ, 6 ГБ и 8 ГБ) за счёт адаптивной точности FP16 и автономной очистки памяти. Этот подход предотвращает скачки фрагментации при многоэтапных конвейерах и использует аварийный режим CPU для поддержания генерации при исчерпании VRAM GPU.
- SDXL Base + Refiner работает на GPU с 8 ГБ, тогда как для карт с 4 ГБ рекомендуется только SDXL Base.
- Адаптивная точность FP16 снижает нагрузку на VRAM, а BuffaloCore динамически изменяет размер тензоров, чтобы избежать переполнения.
- RealESRGANx2 добавляет минимальные накладные расходы даже на GPU с 4 ГБ, а система не требует облачных зависимостей или CUDA.
Этот метод позволяет запускать SDXL офлайн и локально без сбоев на потребительском оборудовании, которое обычно испытывает трудности с требованиями модели к памяти.