NVIDIAはHugging FaceにQwen3.6-27B-NVFP4モデルを公開しました。
チェックポイントは現在ダウンロード可能です。
NVIDIAはHugging FaceにQwen3.6-27B-NVFP4モデルを公開しました。
チェックポイントは現在ダウンロード可能です。
著者は Quantization-Aware Healing (QAH) を導入しました。これは、構造的圧縮と量子化中に失われたパフォーマンスを回復するために、非圧縮モデルから直接 4 ビットの学生モデルを蒸留するパイプラインです。GPT-OSS 120B に適用すると、この手法は Hypernova-60B を生成し、9 つのベンチマークのうち 7 つで bfloat16 ソースと同等またはそれ以上のパフォーマンスを発揮しながら、重みメモリを約 4 分の 1 に抑えています。
著者は、構造的に圧縮された4ビット大規模言語モデルの推論およびコーディング能力を回復させる手法であるQuantization-Aware Healing(QAH)を紹介します。標準的な量子化 aware トレーニングが圧縮モデルを再適合させるのとは異なり、QAHは元の非圧縮モデルから4ビット学生モデルを直接蒸留します。
NVIDIAは、構成可能な推論機能を持つQwen 3.8 2.4Tパラメータモデルを、そのGB300 NVL72ハードウェアプラットフォーム上で提供することをデモンストレーションしました。
Qwenは、そのQwen 3.8 27Bモデルのオープンウェイトをリリースしました。 チェックポイントはHugging Faceで利用可能です。
アリババは、オープンエコシステムに最前線に近い能力をもたらすために設計された、最大のオープンウェイトモデルであるQwen3.8-2.4T-A95B(Qwen3.8-Maxとしても知られる)のオープンウェイトをリリースしました。
アクセス解析とサイト改善のために Cookie を使用します。分析 Cookie を許可または拒否できます。 プライバシーポリシー