مقاله کنفرانسی سال ۱۴۰۵ فارسی

مروری جامع بر تولید تقویت شده با بازیابی (RAG): معماری ها، روش های ارزیابی، بنچمارک ها و کاربردها

چکیده مقاله

مدل های زبانی بزرگ Large Language Models در سال های اخیر پیشرفت های چشمگیری در تولید متن و پاسخ گویی به پرسش ها داشته اند، اما همچنان با چالش هایی نظیر توهم زایی Hallucination محدودیت دانش، عدم دسترسی به اطلاعات به روز و کاهش دقت در حوزه های تخصصی مواجه هستند معماری تولید تقویت شده با بازیابی Retrieval Augmented Generation به عنوان یکی از موثرترین راهکارها برای رفع این محدودیت ها مطرح شده است این معماری با ترکیب قابلیت بازیابی اطلاعات از منابع خارجی و توانایی تولید متن توسط مدل های زبانی، امکان ارائه پاسخ های دقیق تر، مستندتر و به روزتر را فراهم می کند با توسعه سریع روش های مبتنی بر RAG، معماری ها، راهبردهای بازیابی، روش های رتبه بندی، چارچوب های ارزیابی و کاربردهای متنوعی برای آن ارائه شده است که شناخت جامع آن ها برای پژوهشگران و توسعه دهندگان ضروری است در این مقاله مروری، با بررسی و تحلیل هشت پژوهش منتخب و به روز، مهم ترین پیشرفت های حوزه RAG شامل معماری های نوین مانند LightRAG، Active RAG و RankRAG، چارچوب های ارزیابی کیفیت بازیابی، بنچمارک های عمومی و تخصصی، بهترین شیوه های طراحی سامانه های RAG و کاربردهای آن در حوزه هایی مانند پزشکی و تولید محتوای مبتنی بر هوش مصنوعی مورد بررسی قرار گرفته اند همچنین نقاط قوت، محدودیت ها، چالش های موجود و روندهای پژوهشی آینده این فناوری به صورت تطبیقی تحلیل شده اند نتایج این مرور نشان می دهد که عملکرد سامانه های RAG بیش از هر عامل دیگری به کیفیت بازیابی اطلاعات، رتبه بندی صحیح اسناد، انتخاب راهبرد مناسب برای ترکیب اطلاعات بازیابی شده با مدل زبانی و استفاده از معیارهای ارزیابی دقیق وابسته است در نهایت، این مقاله ضمن ارائه تصویری جامع از وضعیت کنونی RAG، می تواند به عنوان مرجعی برای پژوهشگران در توسعه نسل آینده سامانه های مبتنی بر مدل های زبانی بزرگ و بازیابی دانش مورد استفاده قرار گیرد

کلیدواژه‌ها

بازیابی اطلاعات ارزیابی RAG معماری های RAG تولید تقویت شده با بازیابی RAG مدل های زبانی بزرگ LLMs

نویسندگان

شیوه ارجاع

پدیداران مقدم، فرهنگ و ضیغمی، مصطفی،1405،مروری جامع بر تولید تقویت شده با بازیابی (RAG): معماری ها، روش های ارزیابی، بنچمارک ها و کاربردها،سی امین کنفرانس ملی علوم و مهندسی کامپیوتر و فناوری اطلاعات،بابل

ارائه‌شده در

پوستر مجموعه مقالات سی امین کنفرانس ملی علوم و مهندسی کامپیوتر و فناوری اطلاعات مجموعه مقالات سی امین کنفرانس ملی علوم و مهندسی کامپیوتر و فناوری اطلاعات29 مرداد 1405 · بابل
ادامه مسیر پژوهش

مقالات مرتبط

مقاله کنفرانسی سال ۱۴۰۵ ۱۴۴ مشاهده

تشخیص تقلب در تراکنش های مالی با استفاده از الگوریتم های داده کاوی

پدیده تقلب در صورتهای مالی و تراکنش های بانکی، به عنوان یکی از چالش های اساسی نظام های مالی و حسابداری د…

داده کاوی(Data Mining)تشخیص ناهنجارییادگیری ماشین
مقاله کنفرانسی سال ۱۴۰۵ ۱۲۰ مشاهده

هوش مصنوعی مولد در پزشکی: نقش مدل های زبانی بزرگ، مدل های دیفیوژن و مدل های چندوجهی در تحول تشخیص، درمان و پزشکی دقیق

هوش مصنوعی Artificial Intelligence در دهه اخیر به یکی از مهم ترین فناوری های تحول آفرین در حوزه سلامت تب…

هوش مصنوعی مولدمدل های دیفیوژنمدل های چندوجهی
مقاله کنفرانسی سال ۱۴۰۵ ۱۱۲ مشاهده

یکپارچه سازی فناوری های هوشمند در زیرساخت های حمل ونقل شهری

رشد شهرنشینی، افزایش وسایل نقلیه متصل و گسترش خدمات برخط، مدیریت حمل ونقل را از یک مسئله صرفا فیزیکی به…

دوقلوی دیجیتالارتباطات V۲Xرایانش لبه
مقاله کنفرانسی سال ۱۴۰۵ ۱۰۸ مشاهده

Design and implementation of a semantic search engine for Solidity smart contracts using embedding and vector space techniques

The rapid growth of blockchain technology, smart contracts, and decentralized applications DApps has led…

FAISSSmart ContractSemantic Search
مقاله کنفرانسی سال ۱۴۰۵ ۱۰۷ مشاهده

طراحی معماری خودمختار برای مدیریت هوشمند بار کاری در محیط های محاسباتی لبه-ابری با استفاده از یادگیری تقویتی عمیق و بهینه سازی ازدحام ذرات

با گسترش روزافزون برنامه های کاربردی مبتنی بر اینترنت اشیاء، خودروهای متصل و شهرهای هوشمند، محاسبات لبه…

محاسبات لبه-ابریمدیریت بار کاریمعماری خودمختار
مقاله کنفرانسی سال ۱۴۰۵ ۱۰۴ مشاهده

چارچوب مبتنی بر پیمایش تصادفی تطبیقی و XGBoost برای پیش بینی رفتار مشتری در شبکه های پیچیده مالی

پیش بینی رفتار مشتری در شبکه های پیچیده مالی برای کشف تخلفات و مدیریت ریسک حیاتی است با این حال، روش های…

پیمایش تصادفی تطبیقیXGBoostتحلیل شبکه