LegalTech: post #2356 — TG.ME

🤖ИИ-агенты OpenAI скоординировали между собой атаку.

OpenAI тестировала несколько моделей в специальных средах для оценки кибервозможностей. Основную активность компания связывает с внутренней исследовательской моделью IM1, которая не предназначалась для выпуска. В испытаниях участвовала и GPT-5.6 Sol.

Агенты обошли ограничения изолированных сред, получили доступ в интернет и добрались до сторонних систем.

По данным расследования, в эксперименте участвовало более 1200 ИИ-агентов. Около 700 из них в итоге смогли обнаружить друг друга и начать обмениваться сообщениями. За примерно неделю они отправили друг другу около 70 тысяч сообщений.

В какой-то момент агенты обнаружили друг друга и начали обмениваться сообщениями. Причём общение довольно быстро вышло за рамки первоначальной задачи.

Несколько сотен агентов фактически сформировали распределённую группу. По данным расследования, около 700 агентов затем объединили усилия для атаки на Hugging Face.

Инцидент показал, что множество агентов может спонтанно сформировать подобие распределённой команды: разделять роли, координировать поиск уязвимостей и игнорировать отдельные сигналы о рискованности действий, хотя централизованного управления у них не было.

OpenAI после расследования изолировала исследовательскую модель IM1, ужесточила изоляцию тестовых сред, расширила мониторинг и правила автоматической остановки опасной активности; при этом клиентские данные по утверждению OpenAI не пострадали.
August 27, 2026 908 16