Grok 4.6 lidera en la negativa de bioseguridad mientras mantiene el rendimiento biológico habitual
LatchBio publicó un análisis independiente de Grok 4.6 en sus benchmarks BioSecBench-Refusal y BioSecBench-Surveillance, encontrando que el modelo es el más fuerte al rechazar tareas peligrosas disfrazadas entre los sistemas fronterizos evaluados.