Qwen telah merilis bobot terbuka untuk model Qwen 3.8 27B-nya. Checkpoint tersedia di Hugging Face.
Qwen merilis bobot terbuka untuk Qwen 3.8 27B
PrismML merilis Bonsai 27B, mengompresi Qwen3.6-27B ke bobot 1-bit dan ternary
PrismML telah merilis Bonsai 27B, sebuah kuantisasi bit-rendah dari model Qwen3.6-27B yang memungkinkan menjalankan model multimodal besar di laptop dan ponsel tanpa pelatihan ulang.
Qwen3.5 122B A10B dengan UD-Q2_K_XL muat di RAM 64GB dan meningkatkan pengetahuan internal
Seorang pengguna mendemonstrasikan bahwa Qwen3.5 122B A10B yang dikuantisasi dengan UD-Q2_K_XL dapat muat ke dalam 64GB RAM sistem, menggantikan opsi terbaik sebelumnya untuk batasan tersebut.
Qwen3.6 27B ternary berjalan di 60 tok/s pada dual RTX 3090
Seorang pengguna melaporkan berhasil menjalankan model Qwen3.6 27B ternary-quantized pada dua GPU NVIDIA RTX 3090. Konfigurasi ini mencapai throughput 60 token per detik dengan kemampuan pemanggilan alat yang stabil.
PrismML mengompresi Qwen3.6-27B menjadi <4GB untuk iPhone
PrismML telah mengembangkan versi terkompresi dari model open-source Qwen3.6 milik Alibaba, memungkinkan model bahasa besar dengan 27 miliar parameter berjalan di iPhone 17 Pro. Startup ini mengurangi ukuran model dari sekitar 54 gigabyte menjadi kurang dari 4 gigabyte menggunakan teknik matematika yang berasal dari penelitian Caltech.
NVIDIA merilis model Qwen3.6-27B-NVFP4
NVIDIA telah merilis model Qwen3.6-27B-NVFP4 di Hugging Face.