Поигрался с ai-runtime-security-sandbox. Это локальное веб-приложение с игрушечным RAG-чатботом внутри, на котором одним кликом запускаются шесть настоящих атак: prompt injection, самовольный вызов инструментов, утечка данных и так далее. А потом переключаешь тумблер Secure Mode и смотришь, как та же самая атака разбивается о защиту прямо в реальном времени.
Классная штука, чтобы один раз запомнить все слабые места рага, и прикрывать их всегда в разработке.

