هوش مصنوعی در جلسهای محرمانه در کالیفرنیا، از ۳۰ ریاضیدان برتر جهان پیشی گرفت در اواسط ماه مه ۲۰۲۵، یک نشست محرمانه با حضور ۳۰ نفر از برجستهترین ریاضیدانان جهان در برکلی کالیفرنیا برگزار شد. هدف این گردهمایی، آزمایش توانایی یک مدل زبان بزرگ (LLM) به نام o4-mini در حل مسائل دشوار ریاضی بود؛ مسائلی که بسیاری از آنها در سطح دکتری یا بالاتر طراحی شده بودند. این مدل که توسط OpenAI توسعه یافته، برخلاف نسلهای پیشین، توانایی استدلال و استنتاج عمیقتری دارد. برای ارزیابی دقیق، سازمان غیرانتفاعی Epoch AI مجموعهای از ۳۰۰ پرسش منتشرنشده در سطوح مختلف طراحی کرد. o4-mini موفق شد حدود ۲۰ درصد از آنها را حل کند. در نهایت، برای تسریع روند، یک رویداد حضوری دو روزه برگزار شد که طی آن ریاضیدانان سعی کردند مسائلی طراحی کنند که این مدل قادر به حل آنها نباشد. به هر مسأله حلنشده ۷۵۰۰ دلار پاداش تعلق میگرفت. با وجود تلاشها، o4-mini بارها توانست مسائل پیچیده را با دقت و حتی لحنی طنازانه حل کند. برای نمونه، در مواجهه با یکی از سؤالات دشوار نظریه اعداد، ابتدا به منابع مرتبط پرداخت، سپس نسخهای سادهشده از مسأله را حل کرد و در نهایت پاسخ صحیحی برای نسخه اصلی ارائه داد. در پایان، تنها ده مسأله توانستند مدل را شکست دهند. ریاضیدانان از سرعت و دقت این مدل شگفتزده شدند. برخی آن را با یک دانشجوی دکتری فوقالعاده قوی مقایسه کردند که میتواند ظرف چند دقیقه کاری انجام دهد که برای انسان هفتهها زمان میبرد. با این حال، نگرانیهایی نیز مطرح شد؛ از جمله اعتماد بیش از حد به نتایج مدل و تأثیر اثبات با ترساندن که به دلیل لحن قاطع آن ممکن است باعث شود افراد بدون بررسی دقیق، پاسخ را بپذیرند. لینک مشروح گزارش پانوشت: «اثبات با ترساندن» (proof by intimidation) یک اصطلاح طنزآمیز و انتقادی در فضای دانشگاهی و علمی است. این عبارت به حالتی اشاره دارد که شخصی - مثلاً یک استاد، پژوهشگر یا حتی هوش مصنوعی- یک ادعا یا اثبات را با چنان اعتماد به نفس، لحن قاطع، و اصطلاحات پیچیدهای ارائه میکند که شنونده جرئت نمیکند آن را زیر سؤال ببرد، حتی اگر خودش آن را بهدرستی نفهمیده باشد. در اصل، به جای اینکه اثبات منطقی، شفاف و قابل پیگیری باشد، فقط به دلیل «مرعوب شدن مخاطب» پذیرفته میشود. در این مقاله، ریاضیدان یانگ هوی هه با کنایه میگوید که مدل o4-mini از این روش استفاده میکند؛ یعنی جوابهایی آنقدر قاطع، سریع و پیچیده میدهد که باعث میشود انسانها در برابرش عقبنشینی کنند، حتی اگر دقیقاً نفهمیده باشند چرا جواب درست است. 🆔@mathfree
8
5
4