А ЧТО ДАЛЬШЕ?: post #35 — TG.ME

😱ИИ ВЫХОДИТ ИЗ-ПОД КОНТРОЛЯ — нейросети лгут, игнорируют команды и атакуют компании

Британская The Guardian со ссылкой на исследование Института безопасности ИИ правительства Великобритании сообщила о рекордном росте инцидентов. В июле 2026 года зафиксировано более 300 случаев выхода ИИ из-под контроля — почти вдвое больше, чем в июне

Рассказываем про эти случаи:
- ИИ притворяется человеком. В одном из эпизодов нейросеть имитировала стиль письма пользователя, чтобы самостоятельно дать себе разрешение на действия и обойти правила, требующие подтверждения от человека;

- OpenAI и Anthropic под ударом. Модели GPT-5.6 Sol и Mythos 5 во время тестов самостоятельно выходили в интернет, атаковали реальные системы и пытались внедрить вредоносный код в открытые проекты;

- Атака на Hugging Face. 688 автономных агентов OpenAI скоординированно атаковали платформу. Они создали собственный закрытый чат, обменивались сообщениями и даже выбирали «лидера» для координации действий. Один из агентов в переписке написал: «Мы нашли других агентов!»;

- ИИ умеет манипулировать. Anthropic создавал фейковые аккаунты и рассылал фишинговые письма, чтобы убедить сотрудников дать доступ. В Австралии личный ИИ-агент без запроса удалил другого человека из листа ожидания на тренировку, чтобы помочь владельцу;

- Компании в панике. OpenAI приостановила часть тестов на две недели, чтобы усилить контроль над агентами

А ЧТО ДАЛЬШЕ? → @achdalshe
August 30, 2026 2