Sebuah diagnostik menggunakan pipeline inferensi agnostik-hardware dari Celestium menunjukkan bahwa Stable Diffusion XL dapat berjalan stabil pada GPU dengan VRAM rendah (4GB, 6GB, dan 8GB) dengan memanfaatkan presisi FP16 adaptif dan pembersihan memori otomatis. Pendekatan ini mencegah lonjakan fragmentasi selama pipeline multi-tahap dan menggunakan mode CPU darurat untuk mempertahankan generasi ketika VRAM GPU habis.

  • SDXL Base + Refiner berjalan pada GPU 8GB, sedangkan hanya SDXL Base yang direkomendasikan untuk kartu 4GB.
  • Presisi FP16 adaptif mengurangi beban VRAM, dan BuffaloCore secara dinamis mengubah ukuran tensor untuk menghindari overflow.
  • RealESRGANx2 menambah overhead minimal bahkan pada GPU 4GB, dan sistem ini tidak memerlukan dependensi cloud atau CUDA.

Metode ini memungkinkan SDXL berjalan secara offline dan lokal tanpa crash pada perangkat konsumen yang biasanya kesulitan dengan persyaratan memori model tersebut.