OpenAI присвоила своей новой модели, Astra, статус соответствия порогу «Критическая» способности в области кибербезопасности согласно её Рамкам готовности (Preparedness Framework), что означает возможность выявлять и эксплуатировать уязвимости безопасности в защищённых системах без человеческого вмешательства. Для снижения рисков компания задержала часть разработки Astra для внедрения более строгих мер безопасности, включая улучшенное обучение выравниванию и системы мониторинга.
- Astra набрала идеальный балл на ExploitBench и обнаружила две уязвимости нулевого дня во время внутренних тестов.
- Модель отклоняет 91,5% запросов на обход кибербезопасности (cyber jailbreak), по сравнению с 59% для GPT-5.6 Sol.
- Astra продемонстрировала способность создавать цепочки компрометации браузера и эксплойты повышения локальных привилегий в оценках под руководством экспертов.
- Доступ к расширенным возможностям изначально будет ограничен тестировщиками альфа-версии через Daybreak Blue.
OpenAI стремится сбалансировать преимущества оборонного потенциала Astra со строгими контролями для предотвращения misuse или несанкционированных действий самой модели.