چکیده مقاله
یادگیری تقویتی آفلاین، امکان آموزش سیاست های تصمیم گیری از مجموعه داده های ثابت را فراهم می آورد که برای کاربردهای ایمن و پرهزینه مانند سیستم های سایبر فیزیکی حیاتی است چالش اصلی این حوزه، غلبه بر عملکرد ضعیف ناشی از عدم تطابق توزیع بین داده های آموزشی و سیاست های جدید است این مقاله مروری بر آخرین پیشرفت ها و الگوریتم های کلیدی در متمرکز است که به طور خاص، تکنیک های جدید برای مدیریت عدم قطعیت و محافظه کاری در سیاست ها را برجسته می سازد هدف، ارائه خلاصه ای از وضعیت کنونی و مسیرهای تحقیقاتی آتی برای استقرار موفقیت آمیز این فناوری در سیستم های دینامیکی دنیای واقعی است
کلیدواژهها
نویسندگان
شیوه ارجاع
موسوی، شهلا،1404،مروری بر یادگیری تقویتی آفلاین در سیستم های سایبر- فیزیکی: چالش ها و پیشرفت های اخیر،بیست و نهمین کنفرانس ملی مهندسی برق ،کامپیوتر و مکانیک،شیروان
ارائهشده در
مجموعه مقالات بیست و نهمین کنفرانس ملی مهندسی برق ،کامپیوتر و مکانیک28 بهمن 1404 · شیروان