Claude Opus 5.5 已发布,在 SimpleBench 上以 88.4% 的得分领先,并因其生成高质量解释视频的能力而引发社区广泛关注。
- 在视觉评估中,它被评为 Anthropic 迄今为止最好的视觉模型,性能优于 Fable 5 和 GPT-6 Sol,且成本比 Fable 5.1 低约 60%。
- 在 Terminal-Bench-Science 上的推理表现最高达到 62%(高努力程度),但由于强制最低预算限制,在最大努力程度下降至 59%。
- 它与 GPT-6 Astra 并列领先 Terminal-Bench-Science 排行榜,比 Fable 5.1 高出约 20 分。
- 据报道,200 美元的 Claude Code 套餐击败了 Codex,而 Astra 仍是审查和审计任务的首选模型。
此次发布确立了 Opus 5.5 作为顶级前沿模型的地位,其视觉能力和成本效率相较于竞争对手具有显著优势。