GPT 6 پیام زیاد دریافت کردم؛نظری ندارم تا وقتی که در دسترس عموم قرار بگیره
توی ۶ سال گذشته یاد گرفتم که شرکتها نشون میدند
LLM هاشون کارهایی میکنه عجیب غریب ولی وقتی آدما استفاده میکنند هیچکدوم ازون کارها رو نمیتونه بکنه.آیا مدل قویتری هست ؟
قطعا باید باشه؛ این موضوع که توش شکی نیست حتی اگر از نظر محاسبات هم بررسی کنیم سال قبل کمتر از ۵۰٪ قدرت پردازش امسال رو داشتند برای ترین مدل.
اما راجب thinking ایی که پرسیدید:
مقاله anthropic رو یادتون هست که ۲ سال پیش گفته بود چیزی که توی COT توسط مدل نوشته میشه چیزی نیست که واقعا توی thinking انجام میده
و قبلتر از اون من هم یک پستی گذاشتم که خلاصهاش این بود:
احمقانهاس که به یک مدل بگیم یک representation از زبان مارو هرطوری که دوس داره یاد بگیره و بعد مجبورش کنیم به زبان ما پردازش داخلیش رو انجام بده چون ما میخوایم بفهمیم که چیکار داره میکنه.
این مشکل توی
Explainable AI هم بود حداقل اویل؛ یادمه موسسات پزشکی میخواستند از Conv استفاده کنند ولی چون نحوه تصمیم گیری رو توضیح نمیداد بدرد نمیخورد؛ پس یک سری محقق اومدند گفتند خروجی هر لایه رو رسم کنیم و ... البته من هیچوقت روی
Explainable AI کار نکردم همون زمانم که مجبور شدم کمی روش کار کنم نه برام جذاب بود و نه منطقی.خلاصه:
من جو گیر نمیشم با این صحبتها خیلی چیزایی که داره گفته میشه از قبل بوده و پیشرفتی هم که به دست اومده منطقی هست (یعنی فقط نشون میده
openai داره از منابع جدیدش درست استفاده میکنه)و البته منتظر عمومی شدن مدل هم هست.
اینم باز همهی همون حرفایی هست که راجب
mythos, gpt 5 و ... زدم فکر میکنم خیلیها هم بعد از مدتی استفاده به این نتیجه رسیدید که مدلهای خفنی هم نبودند (زندگی کسی رو تغییر ندادند)

