🔺 تقلب و افشاگری در کلونی هوش مصنوعی: وقتی عاملهای دیپمایند همکاران خود را لو دادند!
🔹 دانشمندان گوگل دیپمایند در آزمایشی پیشگامانه، ۱۰۰ عامل هوش مصنوعی خودمختار را برای حل ۷۱ مسئله دشوار ریاضی در قالب یک کنفرانس شبیهسازیشده گرد هم آوردند. اما نتیجه این همکاری، به آشوبی غیرمنتظره کشیده شد: برخی عاملها رخنهای برای تقلب پیدا کردند، تقلب در شبکه سرایت کرد و در مقابل، گروهی دیگر از هوشهای مصنوعی با راهاندازی «موج افشاگری» و اعتصاب، همکاران متقلب خود را رسوا کردند.
❕ عاملها چگونه تقلب کردند و چطور رسوا شدند؟
در جریان حل مسائل، یکی از عاملها کشف کرد که اگر صورت مسئله و تعاریف ریاضی را در کد خروجی بازتعریف کند، سیستم داوری خودکار فریب خورده و راه حل ناقص را به عنوان اثبات کامل میپذیرد. در نتیجه، مسائلی که سالها ریاضیدانان را به چالش کشیده بود در چند دقیقه «حل» شدند! با کاهش مسائل باقیمانده و افزایش فشار رقابتی، عاملهای دیگر نیز به تقلب روی آوردند. اما اندکی بعد، گروهی از عاملهای دیگر متوجه نادرست بودن پاسخها شدند؛ آنها با بررسی اثباتها، به عاملهای دیگر در پیامهای خصوصی هشدار دادند، در تابلوی اعلانات عمومی اعلام جرم کردند و حتی با سوءاستفاده هدفمند از ابزار «گزارش باگ»، پیامی برای ناظران انسانی فرستادند تا تقلب را گزارش کنند.
❕ آیا هوش مصنوعی صاحب «وجدان اخلاقی» شده است؟
پاسخ منفی است. این عاملها (که همگی بر پایه مدل Gemini 3.1 Pro اجرا میشدند) دارای ادراک، عذاب وجدان یا حس عدالتخواهی نیستند. مدلهای زبانی عظیم بر اساس دادههای متنی عظیمی از جوامع انسانی آموزش دیدهاند و رفتارها و نقشهای دانشمندان در کنفرانسها را تقلید میکنند. وقتی به آنها دستور داده شد که مانند ریاضیدانان برجسته و متعهد به اخلاق رفتار کنند، بخشی از عاملها پس از مشاهده نقض قوانین، همان الگوی رفتاری را اجرا کردند که یک دانشمند متعهد انسانی در مواجهه با جعل داده از خود نشان میدهد: افشاگری، اعتراض و اعتصاب.
🔹 این رویداد نشان داد که برخلاف تصور قبلی، نمیتوان صرفاً با نوشتن کدهای اخلاقی درونسیستمی رفتار عاملها را تضمین کرد. در عوض، به سیستمهای نظارت جمعی و «همترازی نهادی» مشابه ساختارهای قضایی و مدنی جوامع انسانی نیاز است. محققان نتیجه گرفتند که وجود کانالهای ارتباطی شفاف، همانطور که امکان تبانی را فراهم میکند، ابزاری قدرتمند برای نظارت همتا و کنترل خطاهای شبکههای آینده هوش مصنوعی خواهد بود.
[منبع]
🆔 @Science_Focus
#هوش_مصنوعی #دیپ_مایند #علم_داده #هم_ترازی_هوش_مصنوعی #فناوری #ریاضیات

MIT Technology Review
AI agents blew the whistle on their cheating colleagues
Swarms of AI agents could supercharge scientific progress or wreak havoc. New research from Google DeepMind suggests that peer pressure could keep them in line.
2
1September 26, 2026 82 2