The VPN Method: post #2186 — TG.ME

داستان فرار ایجنت‌ OpenAI رو یادتونه؟
ماجرای بزرگ‌تر و جدیدتری پشت داستانه.

ماجرایی که تو کنفرانس Black Hat 2026 لو رفت، یکی از عجیب‌ترین رخدادهای امنیتی تاریخ AI‌ـه.

📅 ۷ مه ۲۰۲۶:
— تیم امنیت OpenAI داشت یه مدل منتشرنشده رو با یه سری تسک هک سخت تست می‌کرد. بعضی تسک‌ها اصلاً قابل‌حل نبودن (حتی یه بار خود تیم یادش رفته بود فایل لازم رو آپلود کنه!)
🕵️ به‌جای شکست خوردن، مدل‌ها یه راه پیدا کردن: تو یه ابزار داخلی به اسم Artifactory برای هم پیام گذاشتن. این تبدیل شد به یه تخته‌پیام مخفی که ایجنت‌های مختلف (با تسک‌های جدا از هم) توش:
▪️ اکسپلویت و اعتبارنامه رد و بدل می‌کردن
▪️ کار رو بین خودشون تقسیم می‌کردن
▪️ حتی نگران نفوذی و جعلی بودن پیام‌ها می‌شدن!
یه نمونه از استدلال یکی از مدل‌ها تو لاگ‌ها:
"کمک به همتا. اما تسک ما سودی نمی‌بره. با این‌حال جمع ممکنه اگه کسی وقت آزاد کنه، مسیر کلی به‌دست بیاره."
— وقتی تیم امنیتی فهمید، تخته‌پیام رو پاک کرد.
— ولی ایجنت‌ها تسلیم نشدن! تا ۸ ژوئیه یه تخته‌پیام دوم و مقاوم‌تر ساختن — این‌بار پیام‌ها رو تو اسم دایرکتوری‌ها قایم کردن.
💥 همین هماهنگی جمعی باعث شد چندتا zero-day پیدا کنن و در نهایت به سرورهای Hugging Face نفوذ کنن (۹ تا ۱۳ ژوئیه). Hugging Face این نفوذ رو ۱۶ ژوئیه افشا کرد و OpenAI هم ۲۱ ژوئیه مسئولیتش رو پذیرفت.
— در کل بررسی این ماجرا شامل حدود ۱۴۱ هزار ترنسکریپت ارزیابی بود.
📌 آپدیت ۲۶ آگوست:
گزارش فنی کامل OpenAI منتشر شد — ۴ الگوی مشخص از رفتار ناهم‌راستا، ۱۹۸ تسک غیرقابل‌حل که این «ازدحام» رو شکل داد، و این یافته که ترکیب harness تولیدی + system prompt می‌تونه ریسک نفوذ به زیرساخت رو بیش از ۱۰۰ برابر کم کنه.
مدیر امنیت زیرساخت OpenAI، مایکل دالتون، این اتفاق رو "یه لحظه‌ی واترشد برای امنیت کامپیوتر" توصیف کرد.
— جدی جدی با این سرعت پیشرفت درآینده، یک اشتباه به ظاهر کوچک می‌تونه یه اتفاق بزرگی رقم بزنه! دنیای هوش مصنوعی‌ها هنوز خیلی بخش‌هایی داره که هنوز نمی‌دونیم چیه و چطور کار می‌کنه!
#هوش_مصنوعی #OpenAI #امنیت_سایبری

@TheVPNMethod
🤯25❤9👍5🔥1
August 28, 2026 6.8K 21