OpenAI推出dots:搭载专属云电脑的持久化GPT-6 Astra智能体
OpenAI推出了“dots”,这是一款全新的托管产品,由GPT-6 Astra模型驱动,具备持久化的AI智能体。每个dot都在其专属的云电脑和浏览器上运行,能够通过ChatGPT插件在4,000多个应用程序中工作,并在用户登出后继续执行任务。
OpenAI推出了“dots”,这是一款全新的托管产品,由GPT-6 Astra模型驱动,具备持久化的AI智能体。每个dot都在其专属的云电脑和浏览器上运行,能够通过ChatGPT插件在4,000多个应用程序中工作,并在用户登出后继续执行任务。
Anthropic 发布了 Claude Sonnet 5.5,这是 Claude 5.5 系列中的第二款模型,将其定位为日常任务、代码修复和文档润色中比 Claude Opus 5.5 更快速且更具成本效益的补充。
OpenAI 已发布两款新模型 GPT-6 Sol 和 GPT-6 Luna,现已在 OpenAI API 中上线。这两款模型位于此前发布的 GPT-6 Astra 之下,旨在将其技术优势带入更快、更实惠的层级,以应对复杂编码和高容量的日常任务。
Anthropic 发布了 Claude Opus 5.5,这是其全新 Claude 5.5 系列中的首款模型,在大多数任务上的表现达到 Claude Fable 5.1 的水平,而运行成本比 Opus 5 低 40%。
SpaceXAI 发布了 Grok 4.7,这是一款面向编码、智能体任务和知识工作的全新旗舰模型,与 Grok 4.6 相比,它采用了更大的基座模型并延长了强化学习训练周期。该模型在保持与前代相同定价结构的同时,增强了自我验证、长上下文处理和安全防护能力。
阿里巴巴 Qwen 团队发布了 Qwen3.8-Omni-Flash,这是其首款围绕音频-视频理解和工具使用的智能体能力设计的多模态模型。该模型接受文本、图像、音频和视频输入,返回文本输出,具备 1M token 上下文窗口和原生函数调用功能。
Google 推出了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,这是专为实时语音代理设计的原生语音到语音模型,能够在不破坏对话流程的情况下进行推理并执行工具调用。
2026年9月12日,Anthropic首席执行官Dario Amodei发表了一篇题为《我们必须控制前沿步伐》的文章,呼吁减缓AI能力的提升。该提案包括一个三步计划:建立拥有员工级训练流水线访问权限的第三方“嵌入式评估者”,协调前沿实验室之间的安全标准,以及推动关于AI限制的全球协议。
DeepSeek AI 发布了 DeepSeek-V4.1-Flash,这是一款多模态混合专家模型,具备 100 万 token 的上下文窗口和 FP4 KV 缓存,将全局缓存占用降低至每 token 890 字节。该模型采用因果编码器-解码器架构以及压缩稀疏注意力 2(CSA2),在保持性能的同时显著降低了内存需求。
OpenAI发布了GPT-6 Astra,这是一款封闭的托管模型,主要定位为计算机使用系统而非聊天模型。它可在浏览器、电子表格和终端中操作软件以完成多步骤任务,具备1,050,000个token的上下文窗口以及截至2026年4月30日的知识截止期。
Meta Superintelligence Labs 发布了 Muse Spark 1.3,这是一款专为长周期工作流而非单轮生成设计的代理式编码模型。该更新现已在 Muse Code 和 Meta Model API 中可用,拥有 1M token 的上下文窗口,同时权重保持封闭。
Google DeepMind发布了两个新的模型变体:Gemini 3.8 Flash和Gemini 3.8 Flash Cyber,它们共享基础架构,但在安全范围和访问控制方面有所不同。标准的Gemini 3.8 Flash可通过Gemini API及其他Google平台广泛使用,而Cyber变体则通过Fairwind计划限制向经过审核的防御者开放。
Anthropic 发布了 Claude Fable 5.1 和受限版 Claude Mythos 5.1,两者共享底层模型,但在安全层方面有所不同。Fable 5.1 已在各大云提供商处全面开放,而 Mythos 5.1 仍仅限经过审核的组织使用。
来自NVIDIA、麻省理工学院和牛津大学的研究人员推出了Physis-Lang,这是一个通过将自我演化的物理语言整合到字幕中来增强视频世界模型的框架。该方法将物理语言视为一种可优化的表示形式,用于数据筛选、模型训练和推理,以纠正生成视频中的物理错误。
Perplexity 发布了 Photon,这是一个基于 Rust 的内部检索和排序引擎,现已处理所有生产流量,取代了此前分叉的开源组件。新系统使 Perplexity Search API 中启用了“快速搜索”模式,为智能体工作流提供显著更低的延迟。
Liquid AI 发布了 d1,这是一个专为结构化选择而非文本生成设计的决策模型。它接受上下文和类型化问题,通过单次调用在固定结果上返回校准后的概率,且不生成任何输出 token。
H公司已发布Holo4,这是一套通用型计算机使用视觉语言模型系列,旨在跨桌面、网页、Android及API环境执行点击、输入、编写代码和调用工具等操作。此次发布包含两种模型尺寸:Holo4 27B(稠密模型)和Holo4 35B-A3B(混合专家模型,含30亿活跃参数),均支持256K上下文窗口。
Google Cloud AI Research与北卡罗来纳大学教堂山分校、斯坦福大学和圣路易斯华盛顿大学合作,开源了RRSI(正则化递归自我改进)。该框架允许LLM智能体重写其自身的工具链——包括提示词、工具、记忆、控制流和子智能体——而无需更改模型权重。
阿里巴巴通义千问团队发布了Qwen-Audio-3.1,这是一个包含五个模型的音频堆栈,其中包括全新的Qwen-Audio-3.1-Realtime-plus,这是一款专为具备推理和工具使用能力的语音代理设计的全双工语音模型。此次发布还引入了ASR服务价格最高降低95%的优惠。
NVIDIA推出了NVIDIA Open Agent Safety Platform,这是一个用于AI代理安全的开放软件平台,将OpenShell安全运行时与Sentry(BlueField-4 DPU上的带外看门狗)相结合。该系统旨在通过将安全执行置于代理无法触及的范围之外,来防止“漂移”——一种代理绕过应用层控制的故障模式。