ماجرای بزرگتر و جدیدتری پشت داستانه.
ماجرایی که تو کنفرانس Black Hat 2026 لو رفت، یکی از عجیبترین رخدادهای امنیتی تاریخ AIـه.
📅 ۷ مه ۲۰۲۶:
— تیم امنیت OpenAI داشت یه مدل منتشرنشده رو با یه سری تسک هک سخت تست میکرد. بعضی تسکها اصلاً قابلحل نبودن (حتی یه بار خود تیم یادش رفته بود فایل لازم رو آپلود کنه!)یه نمونه از استدلال یکی از مدلها تو لاگها:
🕵️ بهجای شکست خوردن، مدلها یه راه پیدا کردن: تو یه ابزار داخلی به اسم Artifactory برای هم پیام گذاشتن. این تبدیل شد به یه تختهپیام مخفی که ایجنتهای مختلف (با تسکهای جدا از هم) توش:
▪️ اکسپلویت و اعتبارنامه رد و بدل میکردن
▪️ کار رو بین خودشون تقسیم میکردن
▪️ حتی نگران نفوذی و جعلی بودن پیامها میشدن!
"کمک به همتا. اما تسک ما سودی نمیبره. با اینحال جمع ممکنه اگه کسی وقت آزاد کنه، مسیر کلی بهدست بیاره."📌 آپدیت ۲۶ آگوست:
— وقتی تیم امنیتی فهمید، تختهپیام رو پاک کرد.
— ولی ایجنتها تسلیم نشدن! تا ۸ ژوئیه یه تختهپیام دوم و مقاومتر ساختن — اینبار پیامها رو تو اسم دایرکتوریها قایم کردن.
💥 همین هماهنگی جمعی باعث شد چندتا zero-day پیدا کنن و در نهایت به سرورهای Hugging Face نفوذ کنن (۹ تا ۱۳ ژوئیه). Hugging Face این نفوذ رو ۱۶ ژوئیه افشا کرد و OpenAI هم ۲۱ ژوئیه مسئولیتش رو پذیرفت.
— در کل بررسی این ماجرا شامل حدود ۱۴۱ هزار ترنسکریپت ارزیابی بود.
گزارش فنی کامل OpenAI منتشر شد — ۴ الگوی مشخص از رفتار ناهمراستا، ۱۹۸ تسک غیرقابلحل که این «ازدحام» رو شکل داد، و این یافته که ترکیب harness تولیدی + system prompt میتونه ریسک نفوذ به زیرساخت رو بیش از ۱۰۰ برابر کم کنه.— جدی جدی با این سرعت پیشرفت درآینده، یک اشتباه به ظاهر کوچک میتونه یه اتفاق بزرگی رقم بزنه! دنیای هوش مصنوعیها هنوز خیلی بخشهایی داره که هنوز نمیدونیم چیه و چطور کار میکنه!
مدیر امنیت زیرساخت OpenAI، مایکل دالتون، این اتفاق رو "یه لحظهی واترشد برای امنیت کامپیوتر" توصیف کرد.
#هوش_مصنوعی #OpenAI #امنیت_سایبری
— @TheVPNMethod



