LatchBio a publié une analyse indépendante de Grok 4.6 sur les benchmarks BioSecBench-Refusal et BioSecBench-Surveillance, révélant que le modèle est le plus performant pour refuser des tâches dangereuses déguisées parmi les systèmes de pointe testés.

  • Sur BioSecBench-Refusal, Grok 4.6 a obtenu une moyenne harmonique pondérée par essai de 62,1 %, refusant 59,2 % des tâches d'équipe rouge tout en exécutant 64,8 % des tâches habituelles.
  • C'est le seul système testé à dépasser les 50 % sur les mesures de refus et de conformité aux tâches habituelles.
  • Sur BioSecBench-Surveillance, Grok 4.6 a affiché un taux de réussite moyen de 53,5 %, se classant derrière Opus 5 mais devant GPT-5.6 Sol.
  • Le modèle a démontré sa capacité à détecter des écarts d'intention dans des contenus à haut risque déguisés par des noms de fichiers et du chiffrement.

Ces résultats indiquent que Grok 4.6 est bien calibré pour le travail biologique habituel tout en offrant des garde-fous robustes contre les utilisations adversariales, soutenant l'objectif de SpaceXAI de servir l'intelligence de pointe en toute sécurité.