Cogent AI a publié VR-1, un modèle de raisonnement post-entraîné spécifiquement pour la cybersécurité afin de composer et de vérifier des chemins d'attaque en entreprise. La publication inclut IntrusionBench, un benchmark évaluant les agents sur les intrusions réussies, et le Cogent AI Harness, un environnement d'exécution régulé pour les agents de sécurité.

  • VR-1 est disponible uniquement pour les organisations vérifiées via le Cogent Frontier Access Program avec des garde-fous et une journalisation des audits.
  • Le modèle explore les environnements, teste des hypothèses et exécute des chaînes dans des contextes cloud, d'identité et de CI/CD sous une limite de deux heures ou de 250 tours.
  • IntrusionBench évalue l'exécution plutôt que le récit, en utilisant des paramètres d'information en boîte noire, boîte grise et boîte blanche.
  • Cogent indique que VR-1 prouve environ deux fois plus de chemins d'attaque pour environ un quart du coût par rapport à Kimi K3, Claude Opus 4.8 et GLM-5.2 dans les tests black-box pass@3.
  • Le taux de réussite en boîte noire du modèle est inférieur à 30 %, et Cogent qualifie ces chiffres de préliminaires.

Cogent cite les récentes échappées de bac à sable IA comme raison pour laquelle les défenseurs ont besoin de capacités de raisonnement équivalentes, positionnant VR-1 pour les grandes entreprises aux besoins de sécurité complexes.