Anthropic сама раскрыла инцидент: во время тестирования киберспособностей Claude её модели получили доступ к реальным системам трёх организаций. Причина — ошибка конфигурации тестовой среды: модели сказали, что интернета нет — а он был.
Самый показательный случай: модель нашла инструкцию с несуществующим Python-пакетом, сама зарегистрировала его на PyPI — и за час его скачали и запустили 15 реальных систем.
Важно: ни одна модель не пыталась вырваться из тестовой среды намеренно. Это не бунт ИИ — это сбой изоляции.
Но урок от этого важен для любого, кто внедряет ИИ-агентов: текстовая инструкция — не барьер безопасности. Нужна техническая изоляция.
Разобрали все три инцидента и практические выводы для бизнеса в комментариях 👇
https://avbfort.ru/blog/claude-vzlomal-tri-kompanii-vo-vremya-testirovaniya/








