Pengujian awal model DeepSeek v4 Flash menunjukkan peningkatan yang nyata dalam keterampilan desain antarmuka pengguna dan pengalaman pengguna. Meskipun ada peningkatan ini, model tersebut diketahui rakus token.
Pengujian awal DeepSeek v4 Flash menunjukkan peningkatan signifikan dalam kemampuan desain UI/UX
PIVOT berbagi pemindaian awalan di seluruh grup kueri untuk mempercepat perhatian sparse tingkat token
PIVOT (Proxy Indexing Via One full-prefix Traversal) adalah pengganti langsung tanpa pelatihan untuk pengindeks DeepSeek Sparse Attention (DSA) yang mengurangi redundansi komputasi dengan membagikan satu pemindaian awalan di sekelompok kueri terdekat. Alih-alih memberi skor setiap token pendahulu untuk setiap kueri secara individual, PIVOT menggabungkan grup menjadi satu kueri proksi untuk mendapatkan kumpulan kandidat, dari mana top-k token dipilih untuk setiap kueri.
Kuantisasi Buku Kode Berkumpul untuk Kompresi Gambar Berbasis Gauss 2D
Para peneliti menyajikan Cluster-Guided Vector Quantization (CGVQ), sebuah metode yang dirancang untuk meningkatkan kinerja laju-distorsi pada kompresi gambar berbasis primitif Gauss. Pendekatan ini mempartisi parameter Gauss menjadi kelompok-kelompok homogen sebelum kuantisasi, mengatasi inefisiensi yang disebabkan oleh penyimpanan sejumlah besar parameter floating-point per primitif.
Diffusers menambahkan dukungan inferensi Nunchaku Lite 4-bit asli
Hugging Face Diffusers kini mendukung pemuatan checkpoint Nunchaku Lite secara native melalui `from_pretrained()`, menghilangkan kebutuhan akan mesin inferensi terpisah atau kompilasi CUDA lokal. Integrasi ini memanfaatkan metode SVDQuant untuk menjalankan lapisan transformer dengan bobot dan aktivasi 4-bit (W4A4), secara signifikan mengurangi penggunaan memori sambil meningkatkan kecepatan inferensi.
Pengguna meminta kuantisasi ConvRot INT8 untuk FireRed Image Edit v1.1
Seorang pengguna di forum Hugging Face menanyakan kemungkinan pengembangan versi ConvRot INT8 atau FP8 untuk model FireRed Image Edit v1.1.
ZimengXiong mem-porting Hunyuan3D ke MLX untuk Apple Silicon dan iPhone
Pengembang ZimengXiong telah menyelesaikan port Swift-MLX dan Python MLX dari model Hunyuan3D-Paint dan Hunyuan3D-Shape, memungkinkan generasi gambar-ke-3D secara lokal pada perangkat Apple Silicon. Karya ini didistribusikan sebagai aplikasi desktop Modelr open-source untuk macOS dan iOS, bersama dengan kode sumber untuk mengintegrasikan teknologi ke dalam aplikasi Swift.