← 返回 media r/LocalLLaMA · 1 天前 · open_models 阿里巴巴计划开发拥有5万亿至10万亿参数的AI模型,并推出新芯片 译自 English → 中文 阿里巴巴宣布计划开发一款包含5万亿至10万亿参数的人工智能模型。与此同时,该公司还发布了一款专为支持其基础设施需求而设计的全新定制芯片。 阿里巴巴打算构建一个参数量在5万亿到10万亿之间的AI模型。作为其更广泛技术战略的一部分,该公司推出了一款新开发的芯片。 重要性 2/3 r/LocalLLaMA Alibaba (Qwen) API & product launches Hardware & chips 阅读原文 相关文章 media r/LocalLLaMA · 1 天前 · 19 次浏览 阿里巴巴在云栖大会宣布推出 Qwen 4 阿里巴巴已在云栖大会上正式宣布发布 Qwen 4。 media MarkTechPost · 3 天前 · 18 次浏览 阿里巴巴Qwen团队发布采用交错架构的Qwen3.8-LiveTranslate 阿里巴巴Qwen团队发布了Qwen3.8-LiveTranslate,这是一款下一代实时同步翻译模型,能够在说话者仍在讲话时监听实时语音并返回翻译后的文本和音频。此次发布引入了新的Interleave架构,旨在降低延迟并提升翻译质量。 media Together AI Blog · 13 天前 · 16 次浏览 Together GPU Clusters 新增预emptible节点,成本降低50% Together AI 宣布 Together GPU Clusters on Kubernetes 的预emptible计算公开预览,为可容忍中断的工作负载提供更低成本的选项。预emptible节点利用未使用的 NVIDIA accelerated 容量,并按按需费率的固定50%计费。 media r/LocalLLaMA · 21 天前 · 42 次浏览 Qwen发布Qwen3.8-Max-0902,拥有2.4T参数和1M上下文 Alibaba发布了其大型语言模型Qwen3.8-Max-0902的升级版。新模型拥有2.4万亿参数,支持100万token的上下文窗口。 lab OpenAI News · 29 天前 · 57 次浏览 OpenAI分享Jalapeño芯片性能与全栈计算策略 OpenAI发布了其定制推理芯片Jalapeño的首批实测性能结果,并详细介绍了其整合的“丰裕智能”计算策略。该公司概述了如何将数据中心、芯片、模型和软件相结合,以提升整个系统的效率和经济效益。
media MarkTechPost · 3 天前 · 18 次浏览 阿里巴巴Qwen团队发布采用交错架构的Qwen3.8-LiveTranslate 阿里巴巴Qwen团队发布了Qwen3.8-LiveTranslate,这是一款下一代实时同步翻译模型,能够在说话者仍在讲话时监听实时语音并返回翻译后的文本和音频。此次发布引入了新的Interleave架构,旨在降低延迟并提升翻译质量。
media Together AI Blog · 13 天前 · 16 次浏览 Together GPU Clusters 新增预emptible节点,成本降低50% Together AI 宣布 Together GPU Clusters on Kubernetes 的预emptible计算公开预览,为可容忍中断的工作负载提供更低成本的选项。预emptible节点利用未使用的 NVIDIA accelerated 容量,并按按需费率的固定50%计费。
media r/LocalLLaMA · 21 天前 · 42 次浏览 Qwen发布Qwen3.8-Max-0902,拥有2.4T参数和1M上下文 Alibaba发布了其大型语言模型Qwen3.8-Max-0902的升级版。新模型拥有2.4万亿参数,支持100万token的上下文窗口。
lab OpenAI News · 29 天前 · 57 次浏览 OpenAI分享Jalapeño芯片性能与全栈计算策略 OpenAI发布了其定制推理芯片Jalapeño的首批实测性能结果,并详细介绍了其整合的“丰裕智能”计算策略。该公司概述了如何将数据中心、芯片、模型和软件相结合,以提升整个系统的效率和经济效益。