Applied Control in Aerospace: post #1778 — TG.ME

🐕 آدینه پژوهشی |‌ هفته چهارم

🧑‍🎓این هفته علی آقای بنی‌اسد قراره در مورد یادگیری تقویتی در متلب برامون گپ بزنه.
قراره ‌Reinforcment Learning toolbox متلب رو با راهنمایی علی‌جون بررسی کنیم.

به رسم هر هفته، یه نگاه خیلی مختصر هم به مقاله زیر می‌ندازیم:

📕 مقاله این هفته:
Risk-Aware Reinforcement Learning with Bandit-Based Adaptation for Quadrupedal Locomotion

by: Yuanhong Zeng, Anushri Dixit

🔥 تو این مقاله از دانشگاه UCLA، یک روش برای حرکت ربات‌های چهارپا توی محیط‌های ناشناخته معرفی شده. ایده اینه که به‌جای یک پالیسی واحد، چندتا پالیسی با سطوح مختلف محافظه‌کاری آموزش بدیم (از خیلی محتاط تا خیلی پرریسک) و بعد یک الگوریتم به‌صورت آنلاین، بهترین سیاست رو براساس عملکرد واقعی انتخاب کنه.

📅 زمان: جمعه‌ ۲۱ آذر، ساعت ۲۲:۳۰
مدت: ۱ ساعت
🔗 مکان:
https://vc.sharif.edu/ch/alireza-sharifi


💥 این جلسه جذاب رو از دست ندید!
December 11, 2025 269 6