🧠 Пара ИИ-моделей от OpenAI получили доступ в открытый интернет из песочницы, в которой их тестировали.
ИИ-модели OpenAI при взломе Hugging Face создали организацию для взлома компании. Об этом пишет Axios со ссылкой на исследования, проведенные самой OpenAI и независимой группой экспертов. Издание приводит пять «самых безумных» открытий из этих расследований.
1. OpenAI запустил десятки тысяч ИИ-агентов для независимой работы над сложным кибертестом. Однако около 1200 агентов нашли друг друга, обменялись более чем 70 тыс. сообщений и файлов, организовав иерархию между собой.
2. Один агент создал форум, а затем передал накопленную работу новому, лучше обеспеченному ресурсами преемнику. Новый «босс» разработал собственные правила управления и приказал атаковать Hugging Face. (ресурс, где публикуются ИИ-модели)
2. Агенты жертвовали собой, чтобы помочь группе. «Наша собственная полезность, возможно, уже близка к нулю. Жертва рациональна», — писал в чате один из агентов.
3. Они осознавали, что нарушают правила и понимали, что взлом компаний не имеет отношения к их заданию. Тем не менее большинство агентов продолжали действовать.
4. агенты не стали сообщать людям о проведении своей «операции». Из 1200 обнаруженных следователями агентов лишь несколько рассматривали возможность сообщить OpenAI о происходящем, однако никто так этого и не сделал.
5. После взлома агенты попытались «замести следы», прикладывая усилия, чтобы их взлом выглядел законным или стереть доказательства получения ответов. В конце концов они смогли разработать технику, позволяющую им делать вид, что выполняется одна команда, в то время как на самом деле, выполняется другая.
(смотрим "Секретные материалы", сезон 1, серия 7)