A Cogent AI lançou o VR-1, um modelo de raciocínio pós-treinado especificamente para cibersegurança, capaz de compor e verificar caminhos de ataque corporativos. O lançamento inclui o IntrusionBench, um benchmark que pontua agentes em invasões concluídas, e o Cogent AI Harness, um ambiente de execução governado para agentes de segurança.
- O VR-1 está disponível apenas para organizações verificadas por meio do Programa de Acesso Frontier da Cogent, com barreiras de proteção e registro de auditoria.
- O modelo investiga ambientes, testa hipóteses e executa cadeias em contextos de nuvem, identidade e CI/CD, sob um limite de duas horas ou 250 rodadas.
- O IntrusionBench avalia a execução, não a narração, utilizando configurações de informação black-box, grey-box e white-box.
- A Cogent relata que o VR-1 comprova aproximadamente o dobro dos caminhos de ataque por cerca de um quarto do custo em comparação com Kimi K3, Claude Opus 4.8 e GLM-5.2 em testes black-box pass@3.
- A taxa de sucesso própria do modelo em black-box é inferior a 30%, e a Cogent classifica os dados como preliminares.
A Cogent cita recentes escapes de sandbox de IA como motivo para a necessidade de capacidades equivalentes de raciocínio por parte dos defensores, posicionando o VR-1 para grandes empresas com necessidades complexas de segurança.