Celestium의 하드웨어 비종속 추론 파이프라인에 대한 진단 결과, 적응형 FP16 정밀도와 자율적 메모리 정리 기능을 활용하여 Stable Diffusion XL이 낮은 VRAM을 가진 GPU(4GB, 6GB, 8GB)에서 안정적으로 실행될 수 있음을 보여줍니다. 이 접근 방식은 다단계 파이프라인 중 단편화 급증을 방지하고, GPU VRAM이 고갈되었을 때 생성을 유지하기 위해 비상 CPU 모드를 활용합니다.
- SDXL Base + Refiner는 8GB GPU에서 실행되며, 4GB 카드에는 SDXL Base 전용 실행을 권장합니다.
- 적응형 FP16 정밀도는 VRAM 부하를 줄이고, BuffaloCore가 오버플로우를 피하기 위해 텐서를 동적으로 크기 조정합니다.
- RealESRGANx2는 4GB GPU에서도 최소한의 오버헤드만 추가하며, 이 시스템은 클라우드 또는 CUDA 의존성이 전혀 필요하지 않습니다.
이 방법은 일반적으로 모델의 메모리 요구 사항을 처리하는 데 어려움을 겪는 소비자용 하드웨어에서 SDXL이 충돌 없이 오프라인 및 로컬로 실행될 수 있게 합니다.