LatchBio는 Grok 4.6에 대한 BioSecBench-Refusal 및 BioSecBench-Surveillance 벤치마크에서의 독립 분석을 발표했으며, 테스트된 최전방 시스템 중 위장된 위험 과제를 거부하는 데 가장 강력한 모델임을 발견했습니다.

  • BioSecBench-Refusal에서 Grok 4.6는 62.1%의 시도 가중 기하평균을 달성했으며, 레드팀 과제의 59.2%를 거부하고 일상적인 과제의 64.8%를 완료했습니다.
  • 거부 및 일상 준수 측정치 모두에서 50% 이상의 점수를 얻은 유일한 테스트된 시스템입니다.
  • BioSecBench-Surveillance에서 Grok 4.6는 평균 성공률 53.5%를 기록하여 Opus 5보다 뒤처졌지만 GPT-5.6 Sol보다는 앞섰습니다.
  • 이 모델은 파일 이름과 암호화로 위장된 고위험 콘텐츠에서 의도 불일치를 감지하는 능력을 보여주었습니다.

이러한 결과는 Grok 4.6가 일상적인 생물학적 작업에 잘 맞춰져 있으면서도 적대적 사용에 대해 강력한 보호 장치를 제공하며, SpaceXAI의 최전방 지능을 안전하게 제공하는 목표에 부합함을 나타냅니다.