LatchBio опубликовала независимый анализ Grok 4.6 на бенчмарках BioSecBench-Refusal и BioSecBench-Surveillance, выявив, что модель является наиболее сильной среди протестированных передовых систем в отказе от замаскированных опасных задач.
- На BioSecBench-Refusal Grok 4.6 достигла взвешенного по испытаниям гармонического среднего в 62,1%, отказавшись от 59,2% задач red-team и выполнив 64,8% обычных.
- Это единственная протестированная система, набравшая более 50% как по показателю отказа, так и по показателю выполнения обычных задач.
- На BioSecBench-Surveillance Grok 4.6 показала средний уровень успеха 53,5%, расположившись позади Opus 5, но впереди GPT-5.6 Sol.
- Модель продемонстрировала способность выявлять расхождения намерений в высоко рисковых материалах, замаскированных с помощью имён файлов и шифрования.
Эти результаты указывают на то, что Grok 4.6 хорошо настроена для обычной биологической работы, одновременно обеспечивая надёжные средства защиты от враждебного использования, что поддерживает цель SpaceXAI по безопасному предоставлению передовых интеллектуальных возможностей.