Qwen团队发布了Qwen3.8-Flash-Next模型,该模型现已在ModelScope上可用。
此次发布引入了Qwen3.8-Flash系列的新变体。
Qwen团队发布了Qwen3.8-Flash-Next模型,该模型现已在ModelScope上可用。
此次发布引入了Qwen3.8-Flash系列的新变体。
蚂蚁集团开源了Ling-3.0-flash-Fin,这是Ant Ling家族中首个金融增强模型,由蚂蚁集团与领先金融机构及领域专家共同开发。
Alibaba发布了其大型语言模型Qwen3.8-Max-0902的升级版。新模型拥有2.4万亿参数,支持100万token的上下文窗口。
本周的AI新闻突出了来自Z.ai、腾讯和阿里巴巴的重大开源权重模型发布,以及推理基础设施和智能体基准测试方面的发展。
阿里巴巴Qwen团队发布了Qwen3.8-Flash-Next,这是一个开源权重的多模态混合专家模型,旨在预览即将推出的Qwen4系列架构。该检查点将125B主干与51B N-gram嵌入表和4B多令牌预测模块配对,每个令牌仅激活6B参数。
作者介绍了量化感知修复(QAH),一种直接从 uncompressed 模型中蒸馏4位学生以恢复在结构压缩和量化过程中丢失的性能的管道。应用于 GPT-OSS 120B,该方法生成了 Hypernova-60B,它在9个基准测试中的7个上与 bfloat16 源相匹配或超越,同时使用的权重内存大约减少了4倍。
我们使用 Cookie 来统计访问量并改进网站。您可以接受或拒绝分析 Cookie。 隐私政策