比尔·盖茨打算在今年晚些时候与中国国家主席习近平会面,讨论旨在减轻人工智能相关风险的全球倡议。
盖茨认为,如果美国率先提出此类措施,中国可能会同意对发布潜在危险AI模型进行限制。
比尔·盖茨打算在今年晚些时候与中国国家主席习近平会面,讨论旨在减轻人工智能相关风险的全球倡议。
盖茨认为,如果美国率先提出此类措施,中国可能会同意对发布潜在危险AI模型进行限制。
OpenAI 推出了名为 "AI Futures" 的新博客,专门介绍其战略未来团队的工作。该团队专注于如何在变革性 AI 背景下重构自由社会以保护个人权利。该团队将权力集中视为最严重的长期风险,认为自主系统和机器智能的进步可能使国家能够在不依赖人类合作的情况下投射力量和征收收入。
OpenAI 正在启动一项新倡议,帮助民主监督机构培养理解和监督政府将人工智能用于国家安全所需的专业知识和工具。
初步证据表明其新模型Astra可能达到关键网络安全能力阈值后,OpenAI已暂时放缓模型开发速度,包括对即将推出的模型暂停为期两周的强化学习(RL)训练。这一决定紧随OpenAI与Hugging Face事件之后,旨在随着AI系统能力增强而加强监控、对齐和隔离保障措施。
Anthropic 将在未来的 Claude 模型中实施文本水印,以符合欧盟《人工智能法案》及其关于 AI 生成内容透明度的行为准则。该公司采用 Google DeepMind 发布的 SynthID-Text 方法,该方法在不影响输出质量或增加额外 token 的情况下,在生成的文本中嵌入可检测的模式。
Anthropic 已正式实施一种使用隐写术来标记 Claude AI 生成内容的方法。该技术将不可见的信号嵌入输出文本中,以指示其来源。
我们使用 Cookie 来统计访问量并改进网站。您可以接受或拒绝分析 Cookie。 隐私政策