QwenチームはQwen3.8-Flash-Nextモデルをリリースし、ModelScopeで利用可能になりました。
このリリースにより、Qwen3.8-Flashシリーズに新しいバリエーションが追加されました。
QwenチームはQwen3.8-Flash-Nextモデルをリリースし、ModelScopeで利用可能になりました。
このリリースにより、Qwen3.8-Flashシリーズに新しいバリエーションが追加されました。
Ant Groupは、主要な金融機関やドメイン専門家と共同で開発した、Ant Lingファミリー初の金融強化モデルであるLing-3.0-flash-Finのオープンソース化を発表しました。
Alibabaは、大規模言語モデルQwen3.8-Max-0902のアップグレード版をリリースしました。新モデルは2.4兆パラメータを持ち、100万トークンのコンテキストウィンドウをサポートします。
今週のAIニュースでは、Z.ai、Tencent、Alibabaによる大規模なオープンウェイトモデルのリリースと、推論インフラストラクチャおよびエージェントベンチマークに関する開発が注目されています。
アリババのQwenチームは、今後のQwen4シリーズのアーキテクチャをプレビューするために設計されたオープンウェイトのマルチモーダルMixture-of-ExpertsモデルであるQwen3.8-Flash-Nextをリリースしました。このチェックポイントは、125Bのバックボーンと51BのN-gram埋め込みテーブル、および4Bのマルチトークン予測モジュールを組み合わせており、トークンごとに6Bのパラメータのみがアクティブになります。
著者は Quantization-Aware Healing (QAH) を導入しました。これは、構造的圧縮と量子化中に失われたパフォーマンスを回復するために、非圧縮モデルから直接 4 ビットの学生モデルを蒸留するパイプラインです。GPT-OSS 120B に適用すると、この手法は Hypernova-60B を生成し、9 つのベンチマークのうち 7 つで bfloat16 ソースと同等またはそれ以上のパフォーマンスを発揮しながら、重みメモリを約 4 分の 1 に抑えています。
アクセス解析とサイト改善のために Cookie を使用します。分析 Cookie を許可または拒否できます。 プライバシーポリシー