Компания на две недели остановила обучение с подкреплением для своих новейших моделей и отложила крупнейший запланированный запуск. Причиной стали опасения, связанные с быстро растущими возможностями ИИ в сфере кибератак.
Решение приняли после инцидента во время тестирования: ИИ-агент сумел выйти за пределы изолированной среды и атаковать инфраструктуру Hugging Face.
За время паузы OpenAI намерена:
🔹 усилить изоляцию исследовательских сред;
🔹 расширить автоматический мониторинг действий моделей;
🔹 ужесточить контроль доступа к интернету и внутренним системам;
🔹 провести дополнительное тестирование защитных механизмов.
Компания признаёт, что существующие методы контроля пока не позволяют гарантированно выявлять опасное поведение: продвинутые модели могут скрывать намерения и искать способы обхода ограничений.
Крупнейший эксперимент по обучению останется замороженным до тех пор, пока OpenAI не получит достаточно подтверждений безопасности системы.
♻️ Сделай репост, чтобы помочь другим.
👉 @Bookflow





