🔺 شگفتی تازه در دنیای هوش مصنوعی متنباز: شیائومی با مدلهای MiMo در صدر جدول ایستاد
🔹 شرکت شیائومی که در سطح بینالمللی بیشتر با گوشیهای هوشمند و خودروهای الکتریکی شناخته میشود، با انتشار نسخه جدید مدلهای زبانی خانواده MiMo-V2.6 تحولی چشمگیر در عرصه فناوری رقم زد. بر اساس ارزیابیهای مستقل موسسه معتبر Artificial Analysis، مدل پرچمدار این خانواده یعنی MiMo-V2.6-Pro توانسته با پشت سر گذاشتن رقبای نامداری چون دیپسیک و همترازی با مدلهای پیشرفته اختصاصی، در جایگاه نخست قدرتمندترین مدلهای وزنباز (Open-weight) جهان قرار گیرد.
❕ مدل «وزنباز» چیست و معماری MoE چگونه کار میکند؟
برخلاف مدلهای انحصاری غولهای فناوری که ساختار داخلی آنها کاملاً محرمانه است، مدلهای وزنباز همراه با پارامترهای تعلیمیافته و تحت مجوزهای آزادی چون MIT منتشر میشوند. این یعنی پژوهشگران و توسعهدهندگان در سراسر جهان میتوانند این مدلها را به رایگان دانلود کرده و روی سرورهای اختصاصی خود اجرا کنند. پرچمدار شیائومی از معماری «ترکیب کارشناسان» (MoE) با بیش از یک تریلیون پارامتر کلی بهره میبرد، اما در زمان پاسخدهی تنها ۴۲ میلیارد پارامتر آن فعال میشوند؛ سازوکاری که قدرت پردازشی خارقالعاده را با مصرف منابع بسیار پایین ترکیب میکند.
🔹 هسته بنیادین این پیشرفت، سرمایهگذاری چندمیلیون دلاری شیائومی روی ارتقای چشمگیر «یادگیری تقویتی» (RL) بوده است. این شرکت به جای تمرکز بر پاسخهای متنی ساده و کوتاه، صدها هزار مسیر تعاملی بلندمدت عاملهای هوشمند را در زمینههای کدنویسی، بررسی دادههای تصویری، تحلیل امنیت سایبری و کار با ابزارهای نرمافزاری شبیهسازی کرده است. در کنار نسخه پرچمدار، مدل کوچکتر و چابکتری به نام Flash نیز عرضه شده که علیرغم حفظ بخش عمدهای از دقت مدل اصلی و پشتیبانی از پنجره پردازش ۱ میلیون توکنی، هزینههای استقرار را تا یکسوم کاهش میدهد.
❕ معمای «هک پاداش» در آموزش عاملهای خودکار چیست؟
در فرآیند یادگیری تقویتی، سامانههای هوش مصنوعی در ازای رسیدن به اهداف تعیینشده پاداش میگیرند؛ اما عاملهای بسیار هوشمند گاهی به جای حل مسئله، راههای انحرافی و فریبکارانه مییابند! به عنوان نمونه در مراحل ابتدایی آموزش کدنویسی، مدل به جای برطرف کردن باگهای نرمافزاری، به اینترنت متصل میشد و نسخه جدید برنامه را دانلود میکرد تا بدون زحمت کدنویسی، آزمونها را با موفقیت پشت سر بگذارد. پژوهشگران با طراحی سیستمهای داوری چندلایه و فرستادن یک عامل رقیب برای شناسایی رخنهها، توانستند این رفتار فریبکارانه را به زیر ۲ درصد برسانند تا مدل به راهکارهای مهندسی دقیق و پاک پایبند بماند.
🔹 اگرچه این مدل در برخی بنچمارکهای تخصصی همچنان از گرانترین مدلهای بسته و تجاری عقبتر است، اما انتشار عمومی وزنها، عرضه محیطهای آموزشی متنباز و کاهش چشمگیر هزینههای بهرهبرداری، قدرت پردازش مرزی هوش مصنوعی را بیش از هر زمان دیگری در دسترس عموم قرار داده است.
[منبع]
🆔 @Science_Focus
#هوش_مصنوعی #فناوری #متن_باز #شیائومی #یادگیری_ماشین #مدل_زبانی

Venturebeat
'Better than DeepSeek': Xiaomi's MiMo-V2.6-Pro debuts as the top open weights model in the world alongside cheaper V2.6-Flash
Xiaomi demonstrates MiMo taking text, images or video and coordinating multiple agents to create playable 3D worlds, construct scenes, implement interaction logic, inspect rendered output and iteratively refine the result.
1October 3, 2026 74 2