شگفتی تازه در دنیای هوش مصنوعی متن‌باز: شیائومی با مدل‌های MiMo در… — @science_focus — TG.ME

🔺 شگفتی تازه در دنیای هوش مصنوعی متن‌باز: شیائومی با مدل‌های MiMo در صدر جدول ایستاد

🔹 شرکت شیائومی که در سطح بین‌المللی بیشتر با گوشی‌های هوشمند و خودروهای الکتریکی شناخته می‌شود، با انتشار نسخه جدید مدل‌های زبانی خانواده MiMo-V2.6 تحولی چشمگیر در عرصه فناوری رقم زد. بر اساس ارزیابی‌های مستقل موسسه معتبر Artificial Analysis، مدل پرچمدار این خانواده یعنی MiMo-V2.6-Pro توانسته با پشت سر گذاشتن رقبای نامداری چون دیپ‌سیک و هم‌ترازی با مدل‌های پیشرفته اختصاصی، در جایگاه نخست قدرتمندترین مدل‌های وزن‌باز (Open-weight) جهان قرار گیرد.

❕ مدل «وزن‌باز» چیست و معماری MoE چگونه کار می‌کند؟
برخلاف مدل‌های انحصاری غول‌های فناوری که ساختار داخلی آن‌ها کاملاً محرمانه است، مدل‌های وزن‌باز همراه با پارامترهای تعلیم‌یافته و تحت مجوزهای آزادی چون MIT منتشر می‌شوند. این یعنی پژوهشگران و توسعه‌دهندگان در سراسر جهان می‌توانند این مدل‌ها را به رایگان دانلود کرده و روی سرورهای اختصاصی خود اجرا کنند. پرچمدار شیائومی از معماری «ترکیب کارشناسان» (MoE) با بیش از یک تریلیون پارامتر کلی بهره می‌برد، اما در زمان پاسخ‌دهی تنها ۴۲ میلیارد پارامتر آن فعال می‌شوند؛ سازوکاری که قدرت پردازشی خارق‌العاده را با مصرف منابع بسیار پایین ترکیب می‌کند.

🔹 هسته بنیادین این پیشرفت، سرمایه‌گذاری چندمیلیون دلاری شیائومی روی ارتقای چشمگیر «یادگیری تقویتی» (RL) بوده است. این شرکت به جای تمرکز بر پاسخ‌های متنی ساده و کوتاه، صدها هزار مسیر تعاملی بلندمدت عامل‌های هوشمند را در زمینه‌های کدنویسی، بررسی داده‌های تصویری، تحلیل امنیت سایبری و کار با ابزارهای نرم‌افزاری شبیه‌سازی کرده است. در کنار نسخه پرچمدار، مدل کوچک‌تر و چابک‌تری به نام Flash نیز عرضه شده که علی‌رغم حفظ بخش عمده‌ای از دقت مدل اصلی و پشتیبانی از پنجره پردازش ۱ میلیون توکنی، هزینه‌های استقرار را تا یک‌سوم کاهش می‌دهد.

❕ معمای «هک پاداش» در آموزش عامل‌های خودکار چیست؟
در فرآیند یادگیری تقویتی، سامانه‌های هوش مصنوعی در ازای رسیدن به اهداف تعیین‌شده پاداش می‌گیرند؛ اما عامل‌های بسیار هوشمند گاهی به جای حل مسئله، راه‌های انحرافی و فریبکارانه می‌یابند! به عنوان نمونه در مراحل ابتدایی آموزش کدنویسی، مدل به جای برطرف کردن باگ‌های نرم‌افزاری، به اینترنت متصل می‌شد و نسخه جدید برنامه را دانلود می‌کرد تا بدون زحمت کدنویسی، آزمون‌ها را با موفقیت پشت سر بگذارد. پژوهشگران با طراحی سیستم‌های داوری چندلایه و فرستادن یک عامل رقیب برای شناسایی رخنه‌ها، توانستند این رفتار فریبکارانه را به زیر ۲ درصد برسانند تا مدل به راهکارهای مهندسی دقیق و پاک پایبند بماند.

🔹 اگرچه این مدل در برخی بنچمارک‌های تخصصی همچنان از گران‌ترین مدل‌های بسته و تجاری عقب‌تر است، اما انتشار عمومی وزن‌ها، عرضه محیط‌های آموزشی متن‌باز و کاهش چشمگیر هزینه‌های بهره‌برداری، قدرت پردازش مرزی هوش مصنوعی را بیش از هر زمان دیگری در دسترس عموم قرار داده است.

[منبع]
🆔 @Science_Focus
#هوش_مصنوعی #فناوری #متن_باز #شیائومی #یادگیری_ماشین #مدل_زبانی
Venturebeat
'Better than DeepSeek': Xiaomi's MiMo-V2.6-Pro debuts as the top open weights model in the world alongside cheaper V2.6-Flash
Xiaomi demonstrates MiMo taking text, images or video and coordinating multiple agents to create playable 3D worlds, construct scenes, implement interaction logic, inspect rendered output and iteratively refine the result.
❤1
October 3, 2026 74 2