← 返回 media r/LocalLLaMA · 1 小时前 · open_models 据报道,Qwen 4 计划于 10 月下旬发布 译自 English → 中文 阿里巴巴的一位联系人表示,Qwen 4 模型系列计划于 10 月底推出。这一时间表表明其开发周期比之前的版本更快,而之前的版本之间间隔较长。 该消息来源引用了阿里巴巴一位匿名的“0-day 合作伙伴”作为信息来源。关于哪些模型变体将率先发布的详细信息仍未公开。人们希望 Qwen 4 27B 变体能在今年内可用。 重要性 2/3 r/LocalLLaMA Alibaba (Qwen) 阅读原文 相关文章 arxiv arXiv cs.CL · 14 小时前 · 6 次浏览 T-Search:面向复杂多步搜索的开源智能检索器 研究人员提出了 T-Search,这是一种面向复杂多步搜索任务的开源权重智能检索器。该模型基于 Qwen3.6-35B-A3B 构建,并使用对抗性过滤的合成数据进行训练,能够执行受限的多轮搜索,返回带有理由的排序证据块。 media Hugging Face Forums · 23 小时前 · 14 次浏览 Dev-4B将快速校准决策与基于风险推理升级相结合 作者发布了 Dev-4B,这是一个基于 Qwen3-4B-Instruct 的小型本地模型,能够以校准后的置信度回答关于文档的输入问题。它使用内置路由器决定是提供快速答案,还是仅在初始预测可能错误时升级到逐步推理。 arxiv arXiv cs.LG · 4 天前 · 20 次浏览 做你自己的研究:通过学习搜索来学习预测 研究人员引入了一种基于智能体的预测环境和数据集,该数据集源自超过2100个已解决的Polymarket问题,用于训练语言模型收集自身的证据。该系统允许智能体在 rollout 时通过网页搜索和金融时间序列获取上下文,并通过泄漏过滤进行约束,以确保信息早于问题的截止时间。 arxiv arXiv cs.CL · 6 天前 · 30 次浏览 Index-Translate 发布用于文本、语音和长文档的多语言模型家族 作者介绍了 Index-Translate,这是一个多语言翻译模型家族,结合了共享基础与专门训练,用于通用翻译、指令跟随、语音翻译、受控配音和长文档翻译。该家族包括支持 150 种语言的 2B、9B 和 35B-A3B 模型。 media MarkTechPost · 7 天前 · 33 次浏览 阿里巴巴通义千问发布Qwen-Audio-3.1-Realtime全双工语音模型 阿里巴巴通义千问团队发布了Qwen-Audio-3.1,这是一个包含五个模型的音频堆栈,其中包括全新的Qwen-Audio-3.1-Realtime-plus,这是一款专为具备推理和工具使用能力的语音代理设计的全双工语音模型。此次发布还引入了ASR服务价格最高降低95%的优惠。
arxiv arXiv cs.CL · 14 小时前 · 6 次浏览 T-Search:面向复杂多步搜索的开源智能检索器 研究人员提出了 T-Search,这是一种面向复杂多步搜索任务的开源权重智能检索器。该模型基于 Qwen3.6-35B-A3B 构建,并使用对抗性过滤的合成数据进行训练,能够执行受限的多轮搜索,返回带有理由的排序证据块。
media Hugging Face Forums · 23 小时前 · 14 次浏览 Dev-4B将快速校准决策与基于风险推理升级相结合 作者发布了 Dev-4B,这是一个基于 Qwen3-4B-Instruct 的小型本地模型,能够以校准后的置信度回答关于文档的输入问题。它使用内置路由器决定是提供快速答案,还是仅在初始预测可能错误时升级到逐步推理。
arxiv arXiv cs.LG · 4 天前 · 20 次浏览 做你自己的研究:通过学习搜索来学习预测 研究人员引入了一种基于智能体的预测环境和数据集,该数据集源自超过2100个已解决的Polymarket问题,用于训练语言模型收集自身的证据。该系统允许智能体在 rollout 时通过网页搜索和金融时间序列获取上下文,并通过泄漏过滤进行约束,以确保信息早于问题的截止时间。
arxiv arXiv cs.CL · 6 天前 · 30 次浏览 Index-Translate 发布用于文本、语音和长文档的多语言模型家族 作者介绍了 Index-Translate,这是一个多语言翻译模型家族,结合了共享基础与专门训练,用于通用翻译、指令跟随、语音翻译、受控配音和长文档翻译。该家族包括支持 150 种语言的 2B、9B 和 35B-A3B 模型。
media MarkTechPost · 7 天前 · 33 次浏览 阿里巴巴通义千问发布Qwen-Audio-3.1-Realtime全双工语音模型 阿里巴巴通义千问团队发布了Qwen-Audio-3.1,这是一个包含五个模型的音频堆栈,其中包括全新的Qwen-Audio-3.1-Realtime-plus,这是一款专为具备推理和工具使用能力的语音代理设计的全双工语音模型。此次发布还引入了ASR服务价格最高降低95%的优惠。