هوش مصنوعی در تراپی؛ پر از اطلاعات، تهی از احساس! بنچمارک تخصصی… — نخبگان دنیای هوش مصنوعی و برنامه نویسی🔍🧠 — TG.ME

🧠 هوش مصنوعی در تراپی؛ پر از اطلاعات، تهی از احساس!

بنچمارک تخصصی PsyEval که روی ۱۱ مدل زبانی بزرگ انجام شده، تازه‌ترین گزارش را درباره توانایی‌های واقعی AI در حوزه سلامت روان منتشر کرده است. نتیجه‌اش یک هشدار جدی است: هرچند این ابزارها در حافظه پزشکی قوی‌اند، اما جای خالی انسان هنوز پر نشده است.

بیایید جزئیاتش را ورق بزنیم:

📚 ۱. دانش پزشکی، نمره قبولی
مدل‌ها در پاسخ به سوالات تئوری و حفظیات، عملکرد قابل‌توجهی داشتند. مثلاً مدل Qwen2.5-72B در داده‌های چینی به دقت ۹۱٪ و GPT-4-turbo در داده‌های انگلیسی به ۷۶٪ رسیدند. اما همین مدل‌ها وقتی در سناریوهای اورژانسی روانپزشکی قرار گرفتند، دقتشان افت کرد (GPT-4 به ۷۳٪ رسید) که نشان می‌دهد دانش تئوری با تشخیص موقعیتی فرق دارد.

⚖️ ۲. معمای تشخیص؛ یکی کوته‌بین، یکی پرخطر!
نکته جالب، تضاد رفتاری مدل‌هاست:

· مدل‌های بزرگ مثل GPT-4 به‌شدت محافظه‌کارند و از تشخیص مستقیم طفره می‌روند (مثلاً در تشخیص ADHD به تنها ۲۵٪ دقت رسیدند).
· مدل‌های کوچک مثل LLaMa-3-8B اما شجاع‌ترند و در همان تست به ۱۰۰٪ دقت دست یافتند! اما این شجاعت، خطرناک است چون احتمال تشخیص بیش‌ازحد (Over-diagnosis) را به شدت بالا می‌برد.

💔 ۳. شکاف بزرگ در همدلی و کاوش
اینجا نقطه‌ضعف اصلی مشخص می‌شود. محققان پاسخ‌ها را از نظر «کاوش عاطفی» (پرسیدن سوالات عمیق و حمایتگرانه) بررسی کردند. انسان‌ها با امتیاز بالای ۱٫۹۳ از همه مدل‌ها پیشی گرفتند. AI در گفتارش شیواست، اما در درک لحظه‌های عاطفی و برقراری ارتباط قلبی، هنوز یک ربات خشک باقی می‌ماند. همچنین مشخص شد نوع پرامپت (Scenario Simulation) بیشترین همدلی را القا می‌کند، درحالی که پرامپت‌های گام‌به‌گام پاسخ‌های مکانیکی تحویل می‌دهند.

🔮 جمع‌بندی نهایی
محققان تأکید دارند که AI فعلاً جایگزین روانشناس نیست، بلکه می‌تواند یک دستیار قدرتمند باشد. مسیر آینده نیازمند داده‌های متنوع‌تر فرهنگی و طراحی مکانیزم‌های ایمنی هوشمندانه‌ای است که بدون سخت‌گیری بیش‌ازحد، از کاربران محافظت کند.

📄 مرجع دقیق مقاله:
Jin, H., et al. (2026). PsyEval: a comprehensive large language model evaluation benchmark for mental health. npj Mental Health Research. DOI: 10.1038/s44184-026-00227-0

@AI_MANSOURI
#سلامت_روان #هوش_مصنوعی #روانشناسی_دیجیتال #PsyEval
July 13, 2026 261