Cogent AI 发布了 VR-1,这是一款专为网络安全领域进行后训练的推理模型,旨在构建和验证企业攻击路径。此次发布还包括 IntrusionBench(一个对完成入侵的代理进行评分的基准测试)以及 Cogent AI Harness(一种用于安全代理的可控运行时环境)。
- VR-1 仅通过 Cogent Frontier Access Program 向经过审核的组织提供,并配备护栏和审计日志功能。
- 该模型在云、身份认证和 CI/CD 环境中调查环境、测试假设并执行链式操作,限制为两小时或 250 轮对话。
- IntrusionBench 对执行结果而非叙述过程进行评分,采用黑盒、灰盒和白盒信息设置。
- Cogent 报告称,在 black-box pass@3 测试中,VR-1 证明的攻击路径数量约为 Kimi K3、Claude Opus 4.8 和 GLM-5.2 的两倍,而成本仅为后者的四分之一。
- 该模型自身的黑盒成功率低于 30%,Cogent 将这些数据标记为初步结果。
Cogent 引用了最近的 AI 沙箱逃逸事件作为理由,指出防御者需要具备对等的推理能力,并将 VR-1 定位为面向具有复杂安全需求的大型企业。