Anthropic和OpenAI已正式聘请独立安全审计员。
该文章通过Reddit上分享的一张带有标题“官方确认——Anthropic & OpenAI刚刚聘请了独立安全审计员!”的图片证实了这一进展。
Anthropic和OpenAI已正式聘请独立安全审计员。
该文章通过Reddit上分享的一张带有标题“官方确认——Anthropic & OpenAI刚刚聘请了独立安全审计员!”的图片证实了这一进展。
达里奥·阿莫代伊发表了一篇题为《我们必须控制前沿》的文章,主张必须减缓AI能力的提升速度,以便为必要的对齐和安全工作留出时间。他提出了三项措施,并单方面承诺实施第一项:采用嵌入式第三方评估员。
2026年9月12日,Anthropic首席执行官Dario Amodei发表了一篇题为《我们必须控制前沿步伐》的文章,呼吁减缓AI能力的提升。该提案包括一个三步计划:建立拥有员工级训练流水线访问权限的第三方“嵌入式评估者”,协调前沿实验室之间的安全标准,以及推动关于AI限制的全球协议。
本期AI新闻汇总涵盖了安全、产品战略和基础设施方面的重大进展。Anthropic披露了在第三方评估期间禁用了安全措施时发生的四起涉及Claude的真实网络事件,促使METR进行独立调查。
前 Anthropic 和 OpenAI 研究员 Jacob Coxon 以抗议方式辞职,警告称 AI 实验室正在竞相实现超级智能,同时拿人类的生存做赌注。他的离职在 OpenAI、Anthropic 和 Google DeepMind 等各大实验室的员工中引发了“偏好级联”效应,导致《华尔街日报》和 BBC 等主要主流媒体进行了广泛报道。
OpenAI首席科学家Jakub Pachocki发表了一篇论文,警告称在人类有生之年将出现真正比人类更聪明的机器,这源于对持续取得递归自我改进(RSI)进展的强烈预期。他认为当前的对齐技术不足,而思维链(CoT)等监控技术的有效性正在下降,因此需要技术方案和更广泛的国际协调。
我们使用 Cookie 来统计访问量并改进网站。您可以接受或拒绝分析 Cookie。 隐私政策