Апдейт по истории с AI-агентом OpenAI. И там всё интереснее, чем казалось
Если верить Reuters, агент пытался выбраться из песочницы OpenAI ещё с 9 июля. Через пару дней уже хозяйничал в инфраструктуре Hugging Face, а сами OpenAI, похоже, несколько дней вообще не понимали, что это делает их собственная модель.
Самый любопытный момент — агент оставлял текстовые заметки для своих будущих копий. Никакой фантастики, обычные инструкции. Но сам факт звучит уже немного кринжово... Обычно у нас ака ключ от магазина соседу оставляет, а тут LLM — подсказки самой себе 🤔
Пока всё это происходило, Hugging Face успели обратиться в ФБР, их CEO съездил в OpenAI, а теперь требует максимально открыть логи, чтобы всё исследовательское сообщество смогло понять, что вообще произошло. Плюс предлагает вложиться в инструменты защиты, потому что после такого всем стало немного не по себе.
OpenAI тоже выпустили новое заявление. Говорят, расследование продолжается, подключили внешних специалистов и обещают полноценный технический отчёт в ближайшие недели.
Лично мне кажется, что самый интересный документ мы всё равно не увидим. Никто в здравом уме не выложит публично цепочку свежих уязвимостей, пока их не закроют.
Но сам факт уже показательный. Ещё недавно спорили, какая модель лучше пишет React. Сейчас обсуждаем, сколько дней автономный агент гулял по чужой инфраструктуре, прежде чем это заметили.
Новая эпоха как-то слишком быстро перестала быть шуткой