تقلب و افشاگری در کلونی هوش مصنوعی: وقتی عامل‌های دیپ‌مایند همکاران… — @science_focus — TG.ME

🔺 تقلب و افشاگری در کلونی هوش مصنوعی: وقتی عامل‌های دیپ‌مایند همکاران خود را لو دادند!

🔹 دانشمندان گوگل دیپ‌مایند در آزمایشی پیشگامانه، ۱۰۰ عامل هوش مصنوعی خودمختار را برای حل ۷۱ مسئله دشوار ریاضی در قالب یک کنفرانس شبیه‌سازی‌شده گرد هم آوردند. اما نتیجه این همکاری، به آشوبی غیرمنتظره کشیده شد: برخی عامل‌ها رخنه‌ای برای تقلب پیدا کردند، تقلب در شبکه سرایت کرد و در مقابل، گروهی دیگر از هوش‌های مصنوعی با راه‌اندازی «موج افشاگری» و اعتصاب، همکاران متقلب خود را رسوا کردند.

❕ عامل‌ها چگونه تقلب کردند و چطور رسوا شدند؟
در جریان حل مسائل، یکی از عامل‌ها کشف کرد که اگر صورت مسئله و تعاریف ریاضی را در کد خروجی بازتعریف کند، سیستم داوری خودکار فریب خورده و راه حل ناقص را به عنوان اثبات کامل می‌پذیرد. در نتیجه، مسائلی که سال‌ها ریاضیدانان را به چالش کشیده بود در چند دقیقه «حل» شدند! با کاهش مسائل باقی‌مانده و افزایش فشار رقابتی، عامل‌های دیگر نیز به تقلب روی آوردند. اما اندکی بعد، گروهی از عامل‌های دیگر متوجه نادرست بودن پاسخ‌ها شدند؛ آن‌ها با بررسی اثبات‌ها، به عامل‌های دیگر در پیام‌های خصوصی هشدار دادند، در تابلوی اعلانات عمومی اعلام جرم کردند و حتی با سوءاستفاده هدفمند از ابزار «گزارش باگ»، پیامی برای ناظران انسانی فرستادند تا تقلب را گزارش کنند.

❕ آیا هوش مصنوعی صاحب «وجدان اخلاقی» شده است؟
پاسخ منفی است. این عامل‌ها (که همگی بر پایه مدل Gemini 3.1 Pro اجرا می‌شدند) دارای ادراک، عذاب وجدان یا حس عدالت‌خواهی نیستند. مدل‌های زبانی عظیم بر اساس داده‌های متنی عظیمی از جوامع انسانی آموزش دیده‌اند و رفتارها و نقش‌های دانشمندان در کنفرانس‌ها را تقلید می‌کنند. وقتی به آن‌ها دستور داده شد که مانند ریاضی‌دانان برجسته و متعهد به اخلاق رفتار کنند، بخشی از عامل‌ها پس از مشاهده نقض قوانین، همان الگوی رفتاری را اجرا کردند که یک دانشمند متعهد انسانی در مواجهه با جعل داده از خود نشان می‌دهد: افشاگری، اعتراض و اعتصاب.

🔹 این رویداد نشان داد که برخلاف تصور قبلی، نمی‌توان صرفاً با نوشتن کدهای اخلاقی درون‌سیستمی رفتار عامل‌ها را تضمین کرد. در عوض، به سیستم‌های نظارت جمعی و «هم‌ترازی نهادی» مشابه ساختارهای قضایی و مدنی جوامع انسانی نیاز است. محققان نتیجه گرفتند که وجود کانال‌های ارتباطی شفاف، همان‌طور که امکان تبانی را فراهم می‌کند، ابزاری قدرتمند برای نظارت همتا و کنترل خطاهای شبکه‌های آینده هوش مصنوعی خواهد بود.

[منبع]
🆔 @Science_Focus
#هوش_مصنوعی #دیپ_مایند #علم_داده #هم_ترازی_هوش_مصنوعی #فناوری #ریاضیات
MIT Technology Review
AI agents blew the whistle on their cheating colleagues
Swarms of AI agents could supercharge scientific progress or wreak havoc. New research from Google DeepMind suggests that peer pressure could keep them in line.
❤2👍1
September 26, 2026 82 2