نمایه موضوعی

مقالات حوزه «یادگیری تقویتی»

۴۹ رکورد مرتبط در نمایه علمی‌جو

مقاله کنفرانسی سال ۱۳۹۴ ۱,۳۳۵ مشاهده

طراحی و پیاده سازی کنترل کننده هوشمند تطبیقی برای کنترل تقاطع با استفاده از روش یادگیری تقویتی

امروزه با توسعه زندگی شهرنشینی و افزایش نیاز به حمل و نقل، معضل ازدحام ترافیک تبدیل به یکی از بزرگترین مشکلات پیش روی جوامع بشری شده است لذا برای دست…

تقاطعیادگیری تقویتیکنترل هوشمند ترافیک
مقاله کنفرانسی سال ۱۳۹۴ ۱,۲۴۸ مشاهده

کنترل ترافیک شهری با استفاده از سیستمهای چندعامله سلسله مراتبی و یادگیری تقویتی

با افزایش تعداد خودروها در شبکه های شهری، روشهای کلاسیک در کنترل ترافیک شهری قابل استفاده نبوده ونیاز به روشهای هوشمند افزایش می یابد در این مقاله، ر…

کنترل ترافیک هوشمندسیستمهای چندعاملهساختار سلسله مراتبی
مقاله کنفرانسی سال ۱۴۰۴ ۱,۲۴۰ مشاهده

معرفی و بررسی کاربردهای یادگیری فعال، یادگیری تقویتی و یادگیری انتقالی در مهندسی عمران

یادگیری تقویتییادگیری انتقالییادگیری فعال
مقاله کنفرانسی سال ۱۳۹۵ ۱,۱۳۰ مشاهده

بهبود نتایج یادگیری تقویتی با کمک الگوریتم ژنتیک برای تعیین پارامترهای نرخ یادگیری ونرخ فراموشی

یادگیری تقویتی یکی از حوزههای یادگیری ماشین است و در یادگیری تقویتی، مقادیر نرخ یادگیری و نرخ فراموشی به طور دلخواه تعیین میشوند که مقادیر آنها تاثیر…

نرخ یادگیرینرخ فراموشییادگیری تقویتی
مقاله کنفرانسی سال ۱۳۹۶ ۱,۰۱۷ مشاهده

بهبود سرعت یادگیری در سیستم های چندعاملی با استفاده از یادگیری تقویتی

سیستم های چندعاملی با توجه به مزایا و قابلیت های زیادی که در پی دارند اخیرا زمینه ی تحقیقات زیادی قرار گرفته اند وجود یادگیری در این سیستمها امری ضرو…

یادگیری تقویتیسرعت یادگیریانتقال دانش
مقاله کنفرانسی سال ۱۳۹۹ ۱,۰۱۵ مشاهده

بررسی کاربرد یادگیری ماشین در مدیریت سیستم های ذخیره انرژی هیبریدی در خودرو های الکتریکی هیبریدی

سیستم ذخیره انرژی هیبریدی به خوبی می تواند مشکالت موجود در سیستم های ذخیره انرژی منفرد از نظر تامین توان ویژه و انرژی ویژه بالا در خوردو های الکتریکی…

یادگیری ماشینسیستم مدیریت انرژییادگیری تقویتی
مقاله کنفرانسی سال ۱۴۰۲ ۸۱۳ مشاهده

کنترل بهینه ربات تک لینکی غیرخطی به روش یادگیری تقویتی Q-Learning

کنترل بهینهیادگیری تقویتیتکرار سیاست
مقاله کنفرانسی سال ۱۴۰۱ ۸۱۲ مشاهده

کنترل فاصله و زاویه نسبی یک ربات شبه اتومبیل از طریق یادگیری تقویتی

ربات شبه اتومبیلیادگیری تقویتیشبکه عصبی بازیگر
مقاله کنفرانسی سال ۱۳۹۸ ۷۸۸ مشاهده

سیستم پیشنهاد دهنده در تبلیغات برخط با استفاده از یادگیری تقویتی

سیستم های پیشنهاد دهنده موظف اند ، یک یا تعدادی کالا را از میان انبوهی از کالا ها با ویژگی های مختلف، به یک فرد بر اساس علایق اوپیشنهاد کنند امروزه…

یادگیری تقویتیتبلیغات برخطشبکه عمیقQ
مقاله کنفرانسی سال ۱۳۹۶ ۷۵۰ مشاهده

انتقال یادگیری در سیستم های چندعامله جهت کنترل هوشمند سیگنال های ترافیک

در سالهای اخیر، به دلیل افزایش قابل توجه تعداد وسایل نقلیه و فقدان زیرساخت های مناسب، مساله ی ترافیک در شهرها به خصوص در کلان شهرها تبدیل به یک معضل…

کنترل سیگنال ترافیکانتقال یادگیرییادگیری تقویتی
مقاله کنفرانسی سال ۱۴۰۵ ۷۴۴ مشاهده

ارزیابی کارایی عامل هوشمند در بازی پینگ پنگ با استفاده از الگوریتم های Q-Learning و DQN

سنجش و ارزیابی شایستگی عملیاتی کنش گران هوشمند در بسترهای پویا، از محورهای کلیدی پلتفرم های نوین در مهندسی نرم افزار و سامانه های هوش محور به شمار می…

عامل هوشمندQ-LearningDQN
مقاله کنفرانسی سال ۱۴۰۳ ۷۴۲ مشاهده

یادگیری تقویتی عمیق برای سیستم های چندعاملی

هوش مصنوعییادگیری تقویتییادگیری تقویتی عمیق
مقاله کنفرانسی سال ۱۴۰۳ ۶۲۶ مشاهده

استفاده از یادگیری تقویتی عمیق (DRL) برای افزایش قابلیت های تصمیم گیری مستقل در رباتیک

کاربرد یادگیری تقویتی در ربات ها زیرشاخه ای از یادگیری ماشینی است که با توسعه ربات های مستقلی سروکار دارد که میتوانند بر اساس محیط خود یاد بگیرند و ب…

یادگیری تقویتیرباتیکربات های مستقل
مقاله کنفرانسی سال ۱۳۹۹ ۶۰۷ مشاهده

مسیریابی آگاه از ترافیک به کمک شبکه های نرم افزار - محور با استفاده ازیادگیری تقویتی و منطق فازی

در سالیان اخیر ایده شبکه های نرم افزار محور به عنوان راه حل مناسبی به منظور تسهیل مدیریت شبکه ارائه شده است این معماری توانست عملکردهای مدیریتی شبکه…

تاخیراتلاف بستهیادگیری تقویتی
مقاله کنفرانسی سال ۱۴۰۲ ۴۷۸ مشاهده

بازبینی و بررسی الگوریت مهای زمانبندی جریان کار در محیط ابری

رایانش ابری یک مدل محاسباتی است که امکان استفاده از منابع محاسباتی را بر اساس قانون پرداخت در ازا ی استفاده از آنها برای کاربران فراهم می کند با این…

رایانش ابرییادگیری تقویتیزمانبندی وظایف
مقاله کنفرانسی سال ۱۴۰۳ ۴۶۶ مشاهده

کنترل هوشمند شناور بادبانی خودران با کنترل کننده تناسبی‑انتگرالی نظارت شده با یادگیری تقویتی

اموریت های دریانوردی بلندمدت، مثل اکتشاف در اقیانوس ها، نیازمند شناور های دریایی خودران با مصرف انرژی بهینه است شناورهای بادبانی خودران که از نیروی ب…

یادگیری تقویتیکنترل هوشمندشناور بدون سرنشین
مقاله کنفرانسی سال ۱۴۰۲ ۴۴۵ مشاهده

بهبود عملکرد استخراج اطلاعات از متن با استفاده از تکنیک یادگیری تقویتی

استخراج اطلاعات یعنی استخراج موجودیت ها، روابط بین آن ها و رویدادها از متن یکی از راهکارهای اساسی برای ارتقاء عملکرد سیستم های مبتنی بر پردازش متن ما…

موجودیتپردازش متناستخراج اطلاعات
مقاله کنفرانسی سال ۱۴۰۵ ۴۳۶ مشاهده

واکاوی رفتار عامل هوشمند در محیط بازی Snake Game بر پایه اصول یادگیری تقویتی

یادگیری تقویتیعامل هوشمندبازی Snake
مقاله کنفرانسی سال ۱۴۰۳ ۴۳۳ مشاهده

بررسی رویکردهای یادگیری تقویتی و تقلیدی در طراحی و بازسازی دست رباتیک

چ مهارت دست انسان در انجام حرکات ظریف و دقیق حین انجام وظایف پیچیده، الهام بخش توسعه سیستم های رباتیکی با قابلیت های مشابه است توانایی ربات ها در گرف…

یادگیری تقویتیدست رباتیکیادگیری تقلیدی
مقاله کنفرانسی سال ۱۴۰۳ ۴۱۷ مشاهده

الگوریتم های یادگیری ماشین–مروری

یادگیری ماشینی مطالعه علمی الگوریتم ها و مدل های آماری است که سیستم های رایانه ای برای انجام یک کار خاص بدون برنامه ریزی صریح استفاده می کنند الگوریت…

الگوریتمیادگیری ماشینیادگیری تحت نظارت
مقاله کنفرانسی سال ۱۴۰۳ ۳۹۰ مشاهده

کشف تقلب در صنعت بیمه با استفاده از یک الگوریتم یادگیری تقویتی مبتنی بر نظر خبرگان

یکی از چالش برانگیزترین مسائل در صنعت بیمه، وجود تقلب هایی است که هزینه های گزافی را به صنعت بیمه و بیمه گذاران تحمیل می کنند که موجب بی اعتمادی بیمه…

کشف ناهنجاری/تقلبیادگیری تقویتییادگیری بدون نظارت
مقاله کنفرانسی سال ۱۴۰۴ ۳۶۱ مشاهده

رتبه بندی اعتباری با استفاده از یادگیری تقویتی مبتنی بر الگوریتم راه زن چنددست: مطالعه ای مقایسه ای با مدلهای یادگیری ماشین

شناسایی به موقع و دقیق مشتریان بدحساب یکی از مهمترین چالشهای موسسات مالی در مدیریت ریسک اعتباری است زیرا عدم تشخیص صحیح این دسته از مشتریان می تواند…

ریسک اعتبارییادگیری تقویتیرتبه بندی اعتباری
مقاله کنفرانسی سال ۱۴۰۳ ۳۵۹ مشاهده

استفاده از هوش مصنوعی درکشف تقلب و افزایش رضایت مندی

استفاده از هوش مصنوعی در کشف تقلب به صنعت بیمه کمک کرده تا به شکلی کارآمدتر و منصفانه تر عمل کند و به طور مستقیم با بهبود عملکرد باعث ایجاد اعتماد بی…

هوش مصنوعیرضایت مندییادگیری تقویتی
مقاله کنفرانسی سال ۱۴۰۰ ۳۳۸ مشاهده

بررسی استفاده از فناوری هوش مصنوعی در مسابقات ورزشی

هوش مصنوعی اصطلاحی است که انواع مختلفی از فناوری های هوشمند نامیده می شود وجه مشترک هوش انسان و هوش صنوعی توانایی یادگیری است هوش مصنوعی اطلاعات را م…

هوش مصنوعیمسابقات ورزشییادگیری تحت نظارت