Cogent AI ha lanzado VR-1, un modelo de razonamiento post-entrenado específicamente para ciberseguridad con el fin de componer y verificar rutas de ataque empresariales. El lanzamiento incluye IntrusionBench, una evaluación que califica a los agentes en intrusiones completadas, y Cogent AI Harness, un entorno de ejecución gobernado para agentes de seguridad.
- VR-1 está disponible únicamente para organizaciones verificadas a través del Programa de Acceso Frontier de Cogent con salvaguardas y registro de auditoría.
- El modelo investiga entornos, prueba hipótesis y ejecuta cadenas en contextos de nube, identidad y CI/CD bajo un límite de dos horas o 250 turnos.
- IntrusionBench califica la ejecución en lugar de la narración, utilizando configuraciones de información black-box, grey-box y white-box.
- Cogent informa que VR-1 demuestra aproximadamente el doble de rutas de ataque a cerca de una cuarta parte del costo en comparación con Kimi K3, Claude Opus 4.8 y GLM-5.2 en pruebas black-box pass@3.
- La tasa de éxito propia del modelo en black-box está por debajo del 30%, y Cogent califica las cifras como preliminares.
Cogent cita las recientes fugas de sandbox de IA como razón por la cual los defensores necesitan capacidades de razonamiento equivalentes, posicionando a VR-1 para grandes empresas con necesidades de seguridad complejas.