Topik · Image generation
lab NVIDIA Research · 4 jam lalu · 2 tayangan

Nvidia menghadirkan FusionRelight untuk pencahayaan ulang potret secara real-time melalui fusi pengetahuan domain hibrida

Peneliti dari Nvidia telah memperkenalkan FusionRelight, sebuah metode untuk pencahayaan ulang potret yang menggabungkan transfer iluminasi yang secara fisik masuk akal dengan pelestarian identitas dan inferensi real-time yang ringkas. Pendekatan ini memanfaatkan Fusi Pengetahuan Domain Hibrida (HDKF), sebuah kerangka pelatihan yang mendistilasi prior fisika, reflektansi, dan realisme dari data sintetis, One-Light-at-a-Time (OLAT), dan di alam liar ke dalam model siswa.

lab NVIDIA Research · 18 hari lalu · 13 tayangan

Kuantisasi Buku Kode Berkumpul untuk Kompresi Gambar Berbasis Gauss 2D

Para peneliti menyajikan Cluster-Guided Vector Quantization (CGVQ), sebuah metode yang dirancang untuk meningkatkan kinerja laju-distorsi pada kompresi gambar berbasis primitif Gauss. Pendekatan ini mempartisi parameter Gauss menjadi kelompok-kelompok homogen sebelum kuantisasi, mengatasi inefisiensi yang disebabkan oleh penyimpanan sejumlah besar parameter floating-point per primitif.

lab Hugging Face Blog · 23 hari lalu · 3 tayangan

Diffusers menambahkan dukungan inferensi Nunchaku Lite 4-bit asli

Hugging Face Diffusers kini mendukung pemuatan checkpoint Nunchaku Lite secara native melalui `from_pretrained()`, menghilangkan kebutuhan akan mesin inferensi terpisah atau kompilasi CUDA lokal. Integrasi ini memanfaatkan metode SVDQuant untuk menjalankan lapisan transformer dengan bobot dan aktivasi 4-bit (W4A4), secara signifikan mengurangi penggunaan memori sambil meningkatkan kecepatan inferensi.

media r/LocalLLaMA · 23 hari lalu · 6 tayangan

Microsoft merilis Mage-Flow, model resolusi asli 4B untuk generasi dan pengeditan gambar

Microsoft telah merilis Mage-Flow, tumpukan generatif skala 4B yang ringkas, dirancang untuk generasi teks-ke-gambar yang efisien dan pengeditan gambar berbasis instruksi. Sistem ini mencapai kualitas yang bersaing dengan state-of-the-art melalui desain bersama antara tokenizer ringan, Mage-VAE, dan Native-Resolution Multimodal Diffusion Transformer (NR-MMDiT).

lab Hugging Face Blog · 28 hari lalu · 5 tayangan

NVIDIA NeMo Automodel memungkinkan penalaan halus model difusi terdistribusi dengan Hugging Face Diffusers

NVIDIA dan Hugging Face telah mengintegrasikan NVIDIA NeMo Automodel dengan pustaka 🤗 Diffusers untuk menyediakan pelatihan terdistribusi tingkat produksi untuk model difusi sumber terbuka. Kolaborasi ini memungkinkan pengguna menala halus model format Diffusers apa pun di Hugging Face Hub tanpa memerlukan konversi checkpoint atau penulisan ulang kode model.