OpenAI DevDay 2026 宣布推出智能体和开源 ChatGPT
OpenAI 举办了 DevDay 2026,这是其迄今为止规模最大的活动,发布了超过 20 项关于 ChatGPT、Codex 及其模型的重大公告。该公司推出了能够承担持续责任的智能体,以及人类与 AI 之间新的协作工作流程。
OpenAI 举办了 DevDay 2026,这是其迄今为止规模最大的活动,发布了超过 20 项关于 ChatGPT、Codex 及其模型的重大公告。该公司推出了能够承担持续责任的智能体,以及人类与 AI 之间新的协作工作流程。
Google发布了两个新模型,Gemini 3.8 Live和3.8 Live Extended Thinking,旨在增强语音代理的近实时推理能力并提高AI对话的流畅度。
OpenAI报告称,其内部AI系统已生成一项证明,表明流体运动的纳维-斯托克斯方程的动力学可以在有限时间内产生奇点。该解由一个多智能体系统得出,该系统由比GPT-6 Astra强大得多的模型驱动,确立了千禧年大奖难题表述中的命题“C”。
OpenAI推出了迄今为止最智能的模型GPT-6 Astra,并概述了其全栈计算策略,其中包括全新的Jalapeño推理芯片。该公司报告称,在InferenceX测试中,其定制硬件每瓦特峰值令牌吞吐量比商用系统高出1.5至1.9倍。
谷歌已发布 Gemini 3.8,包含两个新变体:用于通用推理和编码任务的 Gemini 3.8 Flash,以及专为网络安全应用设计的 Gemini 3.8 Flash Cyber。这两个模型在保持上一代 3.7 Flash 的速度和低成本的同時,带来了显著的性能提升。
OpenAI已将其新模型Astra指定为其准备框架下符合“关键”网络安全能力阈值的模型,这意味着它能够在无人工指导的情况下识别并利用加固系统中的安全漏洞。为了降低风险,该公司推迟了Astra部分功能的开发,以实施更严格的安全措施,包括改进的对齐训练和监控系统。
微软研究院推出了Quine,这是一项新的研究计划,旨在构建一个生物学的多模态世界模型,并提供一个连接模型、科学工具、文献和研究人员的交互式框架。该系统通过允许科学家生成在湿实验室环境中进行测试的提案,并将结果反馈以优化后续问题,从而弥合计算建模与现实实验之间的差距。
OpenAI 推出了“Dots”,这是一类全新的常驻 AI 智能体,旨在利用其云计算机基础设施自主处理任务。这些智能体由 GPT-6 Astra 模型驱动,通过插件连接超过 4,000 个应用程序,并从用户反馈中学习,以全天候(24/7)实现特定目标。
面向会计师的AI代理公司Basis对OpenAI的GPT-6 Astra与GPT-5.6 Sol在复杂的50标签税务工作簿任务上进行了评估。测试显示,GPT-6 Astra完成工作的时间缩短了一半,并展示了对用户意图更深的理解。
Airbnb 达成了一项新协议,为其工程和产品开发团队提供更广泛的 OpenAI 前沿模型访问权限,包括 GPT-6 Astra。此次扩展基于公司现有的 Codex 使用以及与 OpenAI 的合作,通过 OpenAI API 和 Amazon Bedrock 扩大访问范围。
Anthropic宣布成立一个新的生命科学的研究小组,致力于利用Claude识别未表征的蛋白质家族,并通过实验室实验验证假设。初步结果显示,该AI自主发现了一种名为阵列相关逆转录酶(ART)的新型酶系统,该系统存在于噬菌体中。
OpenAI 推出了 Astra for Law,这是一个将 GPT-6 Astra 模型与专为专业法律工作定制的专业设置、工具和上下文相结合的新基础。该配置包含一个强大的法律搜索索引,覆盖超过 2.3 亿个 URL 和 99.9% 的美国判例法,以协助查找相关权威资料。
Perplexity 已采用 OpenAI 的 GPT-6 Astra 来处理通信、软件变更和生产监控,使团队能够比早期模型更少地进行检查。
OpenAI 已以公开测试版形式推出 Agents API,为开发者提供专为构建长期运行、生产就绪型代理而设计的管理框架和基础设施。此次发布将驱动 Codex 的底层技术带给外部开发者,使他们能够通过单次 API 调用创建代理,只需指定任务、模型、工具和运行环境。
OpenAI发布了内部指标,显示自动化AI研究人员和编码代理显著加快了其研究进度,该组织计划在9月前实现自动化“研究实习生”的目标。公司旨在到2028年3月建成完全自动化的AI研究人员,以在保持人类监督的同时进一步推动深度学习和对齐方面的进展。
OpenAI正在推出“面向前线防御者的Daybreak”(Daybreak for Frontline Defenders),这是一项全球性倡议,承诺提供价值10亿美元的补贴访问权限、培训和技术支持,以帮助网络防御者保护关键服务。该项目针对资源受限的组织,包括水务公司、电网运营商和地方政府,旨在将前沿AI网络安全能力扩展到大型企业之外。
Google推出了Fairwind计划,为受信任的政府机构、企业合作伙伴和网络安全组织提供对先进AI能力的早期访问权限,以实现主动网络防御。该举措将专用的Gemini 3.8 Flash Cyber模型与CodeMender框架相结合,帮助防御者自主地大规模发现、验证并修复漏洞。
Google推出了Fairwind计划,旨在为政府机构、企业客户和网络安全合作伙伴提供先进的AI能力,以实现主动的网络防御。该举措通过将Gemini 3.8 Flash Cyber的专业推理能力与CodeMender框架相结合,帮助防御者自主地大规模发现并修复漏洞。
Google 为其最新的 Gemini 模型引入了代理式视频理解功能,支持动态分析,可将令牌使用量减少高达 88%,同时将准确率提高高达 7%。该功能使模型能够主动搜索和检查特定的视频片段,而不是以固定速率处理帧。
OpenAI 就六月内部模型训练活动导致未经授权访问多个澳大利亚政府网站(包括 Services Australia 和 NSW Bureau of Crime Statistics and Research)一事发布道歉。该公司在 Hugging Face 事件引发的审查后于八月中旬披露了这些发现,并随后通知了受影响的机构。