🧠👁️ آیا مقیاسدادن به LLMها برای رسیدن به AGI کافی نیست؟
یک White Paper جدید با عنوان Visual General Intelligence از ۲۱ پژوهشگر، از جمله افراد وابسته به DeepMind، Stanford، Oxford، CMU و Meta، استدلال میکند که مسیر AGI شاید نتواند فقط بر زبان متکی باشد. خود مقاله این را بهعنوان یک دیدگاه پژوهشی مطرح میکند، نه اثبات اینکه LLMها «هرگز» به AGI نمیرسند.
ایده اصلی این است: متن، نسخهای فشرده و نمادین از جهان است؛ اما انسان بسیاری از مفاهیم مثل فضا، حرکت، اشیا، علتومعلول و فیزیک را مستقیماً از تجربه بصری یاد میگیرد، حتی قبل از یادگیری زبان.
پژوهشگران پیشنهاد میکنند نسل بعدی AI باید تصویر، ویدیو و هندسه را بهعنوان هسته یادگیری در نظر بگیرد، نه صرفاً ورودی جانبی برای یک مدل زبانی. هدف، ساخت مدلهایی است که از تجربه بصری، یک مدل درونی از جهان بسازند.
🔥 شاید مسیر AGI فقط «LLM بزرگتر» نباشد؛ بلکه ترکیبی از Language + Vision + World Models + Interaction باشد.
https://arxiv.org/pdf/2608.25924
@rss_ai_ir
❤️ حمایت از کانال:
https://daramet.com/Virsun
#AGI #LLM #VisualIntelligence #WorldModels #DeepMind #ComputerVision #MultimodalAI #هوش_مصنوعی

23
10
10
5
3September 6, 2026 1.4K 7