OpenAI признала Astra первой ИИ-моделью критического уровня по… — AiM — TG.ME

OpenAI признала Astra первой ИИ-моделью критического уровня по кибербезопасности

Это уже не «ИИ помогает программисту найти баг». По оценке самой OpenAI, Astra способна с подходящими инструментами самостоятельно находить ранее неизвестные уязвимости и превращать их в рабочие цепочки эксплуатации — в том числе в хорошо защищённых системах.

И это первая модель OpenAI, которой официально присвоен уровень Critical по кибербезопасности.

🧠 Что она уже показала

➡️ 100% на ExploitBench — тесте на разработку эксплойтов для известных уязвимостей.

➡️ Во внутреннем тесте Astra сама обнаружила и использовала два zero-day в цепочке атаки. OpenAI передаёт информацию разработчикам затронутых систем.

➡️ В экспертном тестировании модель нашла неизвестные уязвимости в защищённом браузере, вышла из sandbox и получила возможность выполнять команды на хосте.

➡️ В другом тесте она собрала цепочку повышения привилегий в защищённой ОС — от обычного пользователя до root.

🤯 Почему это важная граница

До сих пор сильные ИИ-модели в кибербезопасности в основном воспринимались как ускорители работы специалиста: написать код, проанализировать лог, найти подозрительное место.

Astra приближается к другой модели: человеку достаточно поставить цель, а ИИ способен самостоятельно искать слабое место, проверять гипотезы и строить эксплуатацию без постоянного управления каждым шагом.

😰 Поэтому OpenAI даже задержала часть разработки и релиза

Компания усиливала защиту от злоупотреблений и несанкционированных действий модели. Доступ к наиболее продвинутым кибервозможностям Astra на старте будет ограничен.

При этом есть интересный парадокс: Astra стала опаснее по возможностям — и одновременно лучше обучена отказываться от вредоносных запросов. В тестах отказов она показала 91,5% против 59% у GPT-5.6 Sol.

Самая важная перемена здесь не в новом рекорде бенчмарка.

ИИ начинает переходить от «помоги найти уязвимость» к «сам найди способ взломать систему». И теперь вопрос безопасности таких моделей становится частью самой разработки.

Подписывайтесь
September 2, 2026 5 1