Anthropic发布了其下一代AI模型Claude Opus 4和Claude Sonnet 4,引入了新的安全措施,旨在防止这些系统被用于开发化学、生物、放射或核(CBRN)武器。

Claude Opus 4是Anthropic最先进的模型,专注于编码和复杂工作流,而Sonnet 4则作为面向开发者任务的通用升级版本。两个模型在SWE-bench和MMMLU等基准测试中均表现出改进的性能,其中Opus 4在SWE-bench上达到72.5%,Sonnet 4得分为72.7%。这些模型具备扩展的记忆系统、并行工具调用功能以及用于长推理链的“Thinking Summaries”。

Anthropic正在为Claude Opus 4启用其AI安全等级3(ASL-3)标准,以实时监控输入和输出,防范与CBRN相关的滥用及权重窃取行为。此次发布还包含更新的API功能,如代码执行工具、用于外部系统的MCP Connector以及提示词缓存优化。

Claude Code现已全面开放,可集成至VS Code等IDE中,使开发者能够直接在各自的工作流中实施反馈并修复错误。