NVIDIA telah merilis model Qwen3.6-27B-NVFP4 di Hugging Face.
Checkpoint kini tersedia untuk diunduh.
NVIDIA telah merilis model Qwen3.6-27B-NVFP4 di Hugging Face.
Checkpoint kini tersedia untuk diunduh.
Para penulis memperkenalkan Quantization-Aware Healing (QAH), sebuah pipa yang mendistilasi siswa 4-bit langsung dari model tanpa kompresi untuk memulihkan kinerja yang hilang selama kompresi struktural dan kuantisasi. Diterapkan pada GPT-OSS 120B, metode ini menghasilkan Hypernova-60B, yang menyamai atau mengalahkan sumber bfloat16 pada 7 dari 9 benchmark sambil menggunakan sekitar 4 kali lebih sedikit memori bobot.
Para penulis memperkenalkan Quantization-Aware Healing (QAH), sebuah metode untuk memulihkan kemampuan penalaran dan pemrograman pada model bahasa besar 4-bit yang terkompresi secara struktural. Berbeda dengan pelatihan sadar kuantisasi standar yang menyesuaikan ulang model terkompresi, QAH mendistilasi siswa 4-bit langsung dari model asli yang tidak terkompresi.
NVIDIA telah mendemonstrasikan layanan model parameter Qwen 3.8 2.4T dengan kemampuan penalaran yang dapat dikonfigurasi pada platform perangkat keras GB300 NVL72-nya.
Qwen telah merilis bobot terbuka untuk model Qwen 3.8 27B-nya. Checkpoint tersedia di Hugging Face.
Alibaba telah merilis bobot terbuka untuk Qwen3.8-2.4T-A95B (juga dikenal sebagai Qwen3.8-Max), model berbobot terbuka terbesarnya, yang dirancang untuk membawa kemampuan mendekati frontier ke ekosistem terbuka.
Kami menggunakan cookie untuk mengukur lalu lintas dan meningkatkan situs. Anda dapat menerima atau menolak cookie analitik. Kebijakan privasi