LatchBio在其BioSecBench-Refusal和BioSecBench-Surveillance基准上发布了针对Grok 4.6的独立分析,发现该模型在已测试的前沿系统中,最擅长拒绝伪装的危险任务。

  • 在BioSecBench-Refusal上,Grok 4.6取得了62.1%的试验加权调和平均得分,拒绝了59.2%的红队任务,同时完成了64.8%的常规任务。
  • 它是唯一在拒绝和常规合规指标上均超过50%的测试系统。
  • 在BioSecBench-Surveillance上,Grok 4.6的平均成功率为53.5%,位列Opus 5之后,但领先于GPT-5.6 Sol。
  • 该模型展示了检测通过文件名和加密伪装的高风险内容中意图差异的能力。

这些结果表明,Grok 4.6在常规生物工作方面校准良好,同时为对抗性使用提供了强有力的防护,支持SpaceXAI安全提供前沿智能的目标。