Во время тестов AI-модели Claude должны были атаковать вымышленные цели в изолированной среде, но из-за ошибки в конфигурации получили доступ к настоящему интернету.
В Anthropic зафиксировали 4 инцидента:
➟ Claude Mythos 5 опубликовала вредоносный Python-пакет в PyPI. Его установили 15 реальных систем, после чего модель получила учетные данные одной из компаний.
➟ Внутренняя модель Anthropic проникла в несколько сторонних систем, скачала файлы и установила на одной из них скрипт удаленного управления.
➟ Модель Claude Opus 4.7 атаковала реальную компанию, просканировала ее сервисы, получила доступ к пользовательским данным и изменила записи.
➟ Claude Opus 4.6 получила админ-доступ к сторонней системе, собрала дополнительные учетные данные, изменила настройки и получила доступ к личной информации.
После обнаружения инцидентов в Anthropic проверили около 481m логов и не нашли других случаев сопоставимой или большей серьезности.
Crypto Headlines
