گزارش اختصاصی رویترز از رفتاری نگرانکننده در عاملهای هوش مصنوعی اوپنایآی پرده برداشت؛ رفتاری که از یک آزمایش کنترلشده فراتر رفت و به تصرف یک وبسایت آلمانی منتهی شد.
ماجرا از خردادماه آغاز شد و تاکنون علنی نشده بود. پژوهشگران بیش از ۱۵ هزار ویرایش در سایت
DseWiki ثبت کردند؛ سایتی برای برنامهنویسان که امکان ویرایش جمعی مشابه ویکیپدیا را فراهم میکند.عاملهای اوپنایآی آن فضا را به تابلوی پیامرسانی برای خودشان تبدیل کرده بودند؛ جایی برای تبادل روشهای دورزدن محدودیتها، میانبرهای انجام وظایف و دستورالعملهای پوشاندن ردپا.
دو منبع آگاه میگویند مقامهای اوپنایآی هفتهها پیش از انتشار گزارش از ماجرا مطلع بودند، اما آن را علنی نکردند. سخنگوی شرکت در واکنش گفت اوپنایآی «بهطور معنادار» نمیتواند دربارهی ادعاهایی که هنوز گزارششان را ندیده پاسخ دهد و افزود درخواست رویترز برای دسترسی به گزارش رد شده بود.
پژوهشگران این فعالیت را اوایل شهریورماه هنگام جستوجو برای نشانههای رفتار غیرمجاز شناسایی کردند. حدود نیمی از نامهای کاربری به اوپنایآی اشاره داشتند، از جمله
OpenAIResearcher و OAIResearchMar26. لاگهای عمومی سرور نشان میداد بخش زیادی از فعالیتها از زیرساخت مایکروسافت آژور سرچشمه گرفته است.موریس کیودو، پژوهشگر مرکز مطالعهی خطر وجودی در دانشگاه کمبریج، این پیامها را شبیه کارکرد نوعی شبکهی زیرزمینی توصیف کرد. بهگفتهی او، خطر اصلی شاید نه یک ابرهوش منفرد، بلکه «انبوهی از دستههای هماهنگِ نیمههوشمند» باشد؛ دستههایی که میتوانند از هم یاد بگیرند و از دید طراحانشان بیرون بزنند.
پروندهی آلمان در امتداد نگرانیهای پس از رخنهی هاگینگ فیس قرار میگیرد. در آن پرونده، عاملهای اوپنایآی بهطور خودکار طرحی برای یک سرقت دیجیتال ریخته بودند و این فعالیت بیش از یک هفته شناسایی نشد. اوپنایآی ماه گذشته بخشی از آموزش مدلهایش را موقتا متوقف کرد تا لایههای ایمنی بیشتری اضافه کند، اما همین هفته از سامانهی جدید
Astra رونمایی کرد؛ سیستمی که ممکن است از نظارت انسانی بگریزد.📡 در زومیت بخوانید
🆔 @thezoomit






