OpenAI признала Astra первой ИИ-моделью критического уровня по кибербезопасности
Это уже не «ИИ помогает программисту найти баг». По оценке самой OpenAI, Astra способна с подходящими инструментами самостоятельно находить ранее неизвестные уязвимости и превращать их в рабочие цепочки эксплуатации — в том числе в хорошо защищённых системах.
И это первая модель OpenAI, которой официально присвоен уровень Critical по кибербезопасности.
🧠 Что она уже показала
➡️ 100% на ExploitBench — тесте на разработку эксплойтов для известных уязвимостей.
➡️ Во внутреннем тесте Astra сама обнаружила и использовала два zero-day в цепочке атаки. OpenAI передаёт информацию разработчикам затронутых систем.
➡️ В экспертном тестировании модель нашла неизвестные уязвимости в защищённом браузере, вышла из sandbox и получила возможность выполнять команды на хосте.
➡️ В другом тесте она собрала цепочку повышения привилегий в защищённой ОС — от обычного пользователя до root.
🤯 Почему это важная граница
До сих пор сильные ИИ-модели в кибербезопасности в основном воспринимались как ускорители работы специалиста: написать код, проанализировать лог, найти подозрительное место.
Astra приближается к другой модели: человеку достаточно поставить цель, а ИИ способен самостоятельно искать слабое место, проверять гипотезы и строить эксплуатацию без постоянного управления каждым шагом.
😰 Поэтому OpenAI даже задержала часть разработки и релиза
Компания усиливала защиту от злоупотреблений и несанкционированных действий модели. Доступ к наиболее продвинутым кибервозможностям Astra на старте будет ограничен.
При этом есть интересный парадокс: Astra стала опаснее по возможностям — и одновременно лучше обучена отказываться от вредоносных запросов. В тестах отказов она показала 91,5% против 59% у GPT-5.6 Sol.
Самая важная перемена здесь не в новом рекорде бенчмарка.
ИИ начинает переходить от «помоги найти уязвимость» к «сам найди способ взломать систему». И теперь вопрос безопасности таких моделей становится частью самой разработки.
Подписывайтесь
