Celestiumのハードウェア非依存推論パイプラインを用いた診断により、Stable Diffusion XLは適応的FP16精度と自律的なメモリクリーンアップを活用することで、低VRAM GPU(4GB、6GB、8GB)で安定して実行できることが示された。このアプローチはマルチステージパイプライン中のフラグメンテーションの急増を防ぎ、GPU VRAMが枯渇した際に生成を維持するために緊急CPUモードを利用する。
- SDXL Base + Refinerは8GB GPU上で動作し、4GBカードにはSDXL Baseのみを推奨。
- 適応的FP16精度はVRAM負荷を軽減し、BuffaloCoreがオーバーフローを防ぐためにテンソルを動的にリサイズする。
- RealESRGANx2は4GB GPU上でも最小限のオーバーヘッドしか加えず、システムはクラウドやCUDA依存を一切必要としない。
この手法により、SDXLは通常モデルのメモリ要件で苦労するコンシューマーハードウェア上で、クラッシュすることなくオフラインかつローカルで実行可能となる。