← 返回 media r/LocalLLaMA · 1 小时前 · open_models Qwen 3.8-Max 发布,在 Vision Arena 中排名第 2 译自 English → 中文 Qwen 3.8-Max 已发布,目前在 Vision Arena 排行榜上位列第 2,仅次于 Claude Fable 5 Max。 Qwen 3.8-Max 在 Vision Arena 中排名第二位,仅次于 Claude Fable 5 Max。Qwen 3.8-Max 的开源权重将于下周发布。Qwen 3.8-27B 的开源版本也计划发布。 重要性 2/3 r/LocalLLaMA Alibaba (Qwen) Benchmark results Open weights 阅读原文 相关文章 media r/LocalLLaMA · 19 天前 · 4 次浏览 InternScience发布Agents-A1-4B,一款用于长周期智能体任务的40亿参数模型 InternScience发布了Agents-A1-4B,这是一个基于Qwen3.5-4B的密集模型,旨在不增加参数量的情况下提升长周期搜索和智能体工作流中的性能。 lab Qwen (Alibaba) · 684 天前 Qwen发布Qwen2.5模型,扩展数据集并增强编码/数学能力 阿里云开源了Qwen2.5系列仅解码器密集语言模型,在现有0.5B至72B参数的阵容中新增三个尺寸(3B、14B和32B)。此次更新将预训练数据集从7万亿token扩展至18万亿token,并整合了来自Qwen2.5-Coder和Qwen-math的技术突破,显著提升在编码、数学和通用知识方面的性能。 media r/LocalLLaMA · 5 小时前 · 2 次浏览 阿里巴巴发布Qwen3.8-27B及Qwen3.8-Max 阿里巴巴宣布发布两款新模型,Qwen3.8-27B和Qwen3.8-Max。 media r/LocalLLaMA · 2 天前 · 5 次浏览 DeepSeek-V4-Flash-0731 实现智能评分 50 DeepSeek-V4-Flash-0731 模型达到了 50 的智能指数分数,这一指标与 2026 年 3 月顶级前沿模型的表现相匹配,当时的分数为 51。 media r/LocalLLaMA · 3 天前 · 1 次浏览 拥有284B总参数和13B活跃参数的开源DeepSeek v4 flash迫使价格下调 Reddit上流传的一个翻译梗图表明,由于DeepSeek v4 flash带来的竞争压力,竞争对手不得不将价格降低80%。该开源模型拥有2840亿总参数和130亿活跃参数,提供了卓越的性价比指标。
media r/LocalLLaMA · 19 天前 · 4 次浏览 InternScience发布Agents-A1-4B,一款用于长周期智能体任务的40亿参数模型 InternScience发布了Agents-A1-4B,这是一个基于Qwen3.5-4B的密集模型,旨在不增加参数量的情况下提升长周期搜索和智能体工作流中的性能。
lab Qwen (Alibaba) · 684 天前 Qwen发布Qwen2.5模型,扩展数据集并增强编码/数学能力 阿里云开源了Qwen2.5系列仅解码器密集语言模型,在现有0.5B至72B参数的阵容中新增三个尺寸(3B、14B和32B)。此次更新将预训练数据集从7万亿token扩展至18万亿token,并整合了来自Qwen2.5-Coder和Qwen-math的技术突破,显著提升在编码、数学和通用知识方面的性能。
media r/LocalLLaMA · 5 小时前 · 2 次浏览 阿里巴巴发布Qwen3.8-27B及Qwen3.8-Max 阿里巴巴宣布发布两款新模型,Qwen3.8-27B和Qwen3.8-Max。
media r/LocalLLaMA · 2 天前 · 5 次浏览 DeepSeek-V4-Flash-0731 实现智能评分 50 DeepSeek-V4-Flash-0731 模型达到了 50 的智能指数分数,这一指标与 2026 年 3 月顶级前沿模型的表现相匹配,当时的分数为 51。
media r/LocalLLaMA · 3 天前 · 1 次浏览 拥有284B总参数和13B活跃参数的开源DeepSeek v4 flash迫使价格下调 Reddit上流传的一个翻译梗图表明,由于DeepSeek v4 flash带来的竞争压力,竞争对手不得不将价格降低80%。该开源模型拥有2840亿总参数和130亿活跃参数,提供了卓越的性价比指标。