Anthropic 发布了 Claude Fable 5.1 和 Claude Mythos 5.1,作为其面向编码和知识工作的新旗舰模型,定位为全球最先进的自主多步任务模型。
- 该模型在 Terminal-Bench-Science(52.6%)和 HLE(59.1%)等基准测试中创下新的 SOTA 成绩,Artificial Analysis Intelligence Index 得分为 66。
- Anthropic 推出了用于智能体可观测性的 Enterprise Frontier Safeguards (EFS) 以及零数据保留支持,以促进企业采用。
- 输入和输出定价保持不变,缓存读取价格降低 75%,至每百万 token $0.25。
- 初步分析表明,Fable 和 Mythos 5.1 可能共享底层权重,但具有不同的安全或路由行为,而非独立的基座模型。
此次发布旨在通过提升速度、详细程度和语气,解决此前关于实用性不足的批评,面向需要可靠自主智能体进行长周期问题求解的用户。