LatchBioがGrok 4.6のBioSecBench-RefusalおよびBioSecBench-Surveillanceベンチマークにおける独立分析を発表し、同モデルがテストされた最先端システムの中で隠蔽された危険なタスクを拒否する能力で最も優れていることを明らかにした。

  • BioSecBench-試行重み付き調和平均において、Grok 4.6は62.1%を達成し、レッドチームタスクの59.2%を拒否しつつ、通常のタスクの64.8%を完了した。
  • 拒否と通常準拠の両方の指標で50%以上のスコアを記録したのはテストされたシステムの中でGrok 4.6のみである。
  • BioSecBench-Surveillanceでは、Grok 4.6は成功率の平均53.5%を示し、Opus 5に次いでGPT-5.6 Solを上回った。
  • 同モデルは、ファイル名や暗号化で隠蔽された高リスクコンテンツにおける意図の不一致を検出する能力を示した。

これらの結果は、Grok 4.6が通常の生物学的作業に対して適切に調整されており、敵対的利用に対する堅牢な保護を提供していることを示しており、SpaceXAIの最先端インテリジェンスを安全に提供するという目標を支えるものである。