چکیده مقاله
استفاده از برنامه ریزی پویای استوکستیک SDP در بهینه سازی مسائل بزرگ مقیاس بهره برداری از مخازن سدها به دلیل نیاز به گسسته سازی متغیرهای حالت و تصمیم، و در نتیجه مشکل ابعادی با محدودیتهای جدی مواجه است روش یادگیری تقویتی RL یکی از تکنیک های پیشرفته در حل مسائل تصمیم گیری متوالی در محیط استوکستیک و مبتنی بر شبیه سازی است RL می تواند باپیدا کردن سیاست بهینه برای حالتهایی از سیستم که درواقعیت بیشتر رخ می دهند به جوابهای نزدیک به جواب بهینه، در زمان قابل قبول نایل شود در این مقاله، مساله بهینه سازی بهره برداری از سد مخزنی چراغ ویس واقع در استان کردستان به عنوان مطالعه موردی با استفاده از روش RL مطالعه شده و با روش SDP مقایسه گردیده است نتایج نشان دهنده همگرایی مطلوب روش RL در نیل به جواب بهینه است
کلیدواژهها
نویسندگان
شیوه ارجاع
�ریف، بهزاد و موسوی، سیدجمشید،1385،بهینه سازی بر مبنای شبیه سازی در بهره برداری از مخازن سدها: رویکرد یادگیری تقویتی،دومین کنفرانس مدیریت منابع آب،اصفهان