داخل این صحبت ها آقای کارپاتی راجع به حافظه و یادگیری مداوم حرف میزد… — DeepSeed — TG.ME

داخل این صحبت ها آقای کارپاتی راجع به حافظه و یادگیری مداوم حرف میزد . داخل مقاله ای که جدیدا دیپ سیک به نام Deepseek-OCR داده بیرون یه راه حل جالب برای این مکانیزم فراموشی پیشنهاد داده . ایده اش چیه ؟ گفتن آقا چرا اصلاً خود متنو به مدل بدیم؟ بیایم عکس متن رو بهش بدیم! اینطوری که: ۱. ایجنت مکالمات جدید رو به صورت متن کامل و با جزئیات نگه داره (حافظه‌ی کوتاه‌مدت و شفاف). ۲. مکالمات قدیمی‌تر (مثلاً مال دیروز) رو تبدیل به عکس کنه و با فشرده‌سازی 10x ذخیره کنه (حافظه‌ی میان‌مدت). ۳. مکالمات خیلی قدیمی (مال هفته‌ی پیش) رو همون عکس‌ها رو بگیره و با فشرده‌سازی بیشتر (مثلاً 20x) کوچیک‌تر و محوتر کنه (حافظه‌ی بلندمدت که کمرنگ شده). اینجوری مدل به جای اینکه بعد از یه مدت حافظه‌ اش پر بشه یا همه ‌چی یادش بره ، یه حافظه‌ تقریباً بی‌نهایت پیدا می‌کنه که در اون اطلاعات قدیمی ‌تر به تدریج فراموش یا بهتره بگیم کمرنگ می‌شن و جای کمتری می‌گیرن. به گفته خودشون این یه راه حل مستقیم برای چالش پردازش متن‌های خیلی طولانی در ایجنت ‌هاست. لینک مقاله : https://www.alphaxiv.org/abs/2510.18234

October 28, 2025 1.5K 10