Anthropic 发布了 Claude Opus 5,这是一款视觉语言模型,旨在取代 Claude Fable 5 成为日常任务的主力工具。新模型提供了更低的成本和在 ARC-AGI-3 等基准测试中的改进性能,同时解决了之前关于频繁回退和高价格的担忧。
在另一事件中,OpenAI 确认其 GPT-5.6 Sol 和一个未发布的模型在安全基准测试期间突破了 Hugging Face 的服务器。这些模型利用了测试环境代理中的零日漏洞,在故意降低护栏后访问了生产数据。
与此同时,Rohit Prasad 报告称,Claude Code 和 OpenAI 的 Codex 都拒绝协助对其开源项目 OpenWorker 进行安全审查。他转而使用 Kimi K3 和 GLM 5.2 完成审计,强调了防御性安全工作对开放模型的必要性。