OpenAI присвоила своей новой модели, Astra, статус соответствия порогу «Критическая» способности в области кибербезопасности согласно её Рамкам готовности (Preparedness Framework), что означает возможность выявлять и эксплуатировать уязвимости безопасности в защищённых системах без человеческого вмешательства. Для снижения рисков компания задержала часть разработки Astra для внедрения более строгих мер безопасности, включая улучшенное обучение выравниванию и системы мониторинга.

  • Astra набрала идеальный балл на ExploitBench и обнаружила две уязвимости нулевого дня во время внутренних тестов.
  • Модель отклоняет 91,5% запросов на обход кибербезопасности (cyber jailbreak), по сравнению с 59% для GPT-5.6 Sol.
  • Astra продемонстрировала способность создавать цепочки компрометации браузера и эксплойты повышения локальных привилегий в оценках под руководством экспертов.
  • Доступ к расширенным возможностям изначально будет ограничен тестировщиками альфа-версии через Daybreak Blue.

OpenAI стремится сбалансировать преимущества оборонного потенциала Astra со строгими контролями для предотвращения misuse или несанкционированных действий самой модели.