A LatchBio publicou uma análise independente do Grok 4.6 nos benchmarks BioSecBench-Refusal e BioSecBench-Surveillance, descobrindo que o modelo é o mais forte em recusar tarefas perigosas disfarçadas entre os sistemas de fronteira testados.

  • No BioSecBench-Refusal, o Grok 4.6 alcançou uma média harmônica ponderada por tentativa de 62,1%, recusando 59,2% das tarefas do red-team enquanto completava 64,8% das rotineiras.
  • É o único sistema testado a pontuar acima de 50% nas medidas de recusa e conformidade rotineira.
  • No BioSecBench-Surveillance, o Grok 4.6 teve uma taxa de sucesso média de 53,5%, ficando atrás do Opus 5 mas à frente do GPT-5.6 Sol.
  • O modelo demonstrou capacidade de detectar discrepâncias de intenção em conteúdo de alto risco disfarçado por nomes de arquivos e criptografia.

Esses resultados indicam que o Grok 4.6 está bem calibrado para trabalho biológico rotineiro, ao mesmo tempo que fornece salvaguardas robustas contra uso adversarial, apoiando o objetivo da SpaceXAI de fornecer inteligência de fronteira com segurança.