用户 Achilles1089 在 Hugging Face 上上传了一个无审查的 "fable 和 opus 4.8" 混合模型,声称数据证明了其有效性。
该模型是。
用户 Achilles1089 在 Hugging Face 上上传了一个无审查的 "fable 和 opus 4.8" 混合模型,声称数据证明了其有效性。
该模型是。
阿里巴巴的Qwen团队宣布了Qwen 3.8 Max,这是一款专注于编码、长周期智能体工作和多模态推理的新旗舰模型,拥有2.4T参数。该公司确认,Qwen 3.8 Max以及较小的Qwen 3.8-27B的开放权重版本将于下周发布。
阿里巴巴宣布开源 Qwen3.8,这是一个拥有 2.4 万亿参数的模型,同时开源了其“玄武”AI 芯片软件技术栈,以减少对英伟达 CUDA 生态系统的依赖。
阿里巴巴发布了Qwen3.6-27B,这是一个拥有270亿参数的新密集开源模型,在几乎所有测试过的编程基准测试中都优于其大得多的前代模型Qwen3.5-397B-A17B。
阿里巴巴 Qwen 团队于 2025 年 7 月发布了 Qwen3-Coder-480B-A35B-Instruct,这是一个拥有 4800 亿参数的 Mixture-of-Experts 模型,每次推理仅激活 350 亿个参数。其编程性能可与 Claude Sonnet 4 和 GPT-4 相媲美,且在 Apache 2.0 许可下完全开源。
Qwen团队推出了Qwen2.5-Coder系列,这是一组源自Qwen2.5架构的新型代码专用语言模型。该系列包含六个模型尺寸,参数量从0.5B到32B不等,并在超过5.5万亿个经过清理的源代码和合成数据令牌上进行训练。
我们使用 Cookie 来统计访问量并改进网站。您可以接受或拒绝分析 Cookie。 隐私政策