🐕 آدینه پژوهشی | هفته چهارم
🧑🎓این هفته علی آقای بنیاسد قراره در مورد یادگیری تقویتی در متلب برامون گپ بزنه.
قراره Reinforcment Learning toolbox متلب رو با راهنمایی علیجون بررسی کنیم.
به رسم هر هفته، یه نگاه خیلی مختصر هم به مقاله زیر میندازیم:
📕 مقاله این هفته:
Risk-Aware Reinforcement Learning with Bandit-Based Adaptation for Quadrupedal Locomotion
by: Yuanhong Zeng, Anushri Dixit
🔥 تو این مقاله از دانشگاه UCLA، یک روش برای حرکت رباتهای چهارپا توی محیطهای ناشناخته معرفی شده. ایده اینه که بهجای یک پالیسی واحد، چندتا پالیسی با سطوح مختلف محافظهکاری آموزش بدیم (از خیلی محتاط تا خیلی پرریسک) و بعد یک الگوریتم بهصورت آنلاین، بهترین سیاست رو براساس عملکرد واقعی انتخاب کنه.
📅 زمان: جمعه ۲۱ آذر، ساعت ۲۲:۳۰
⏱ مدت: ۱ ساعت
🔗 مکان:
https://vc.sharif.edu/ch/alireza-sharifi
💥 این جلسه جذاب رو از دست ندید!
Forwarded fromآدینه پژوهشی | Friday Night Research
December 11, 2025 269 6