چکیده مقاله
یکی از مهمترین موضوعات در پردازش زبان طبیعی و بازیابی اطلاعات، یافتن ریشه کلمات است یکی از روشهای افزایش کارایی سیستمهای بازیابی اطلاعات، استفاده از ریشهیابی کلمات است زیرا اشتقاقات مختلف یک کلمه به ریشه آنکلمه تبدیل میشوند درنتیجه جستجو بر اساس ریشه کلمه انجام خواهد شد و اندازه ساختار ایندکس کاهش مییابد حال با توجه به پیچیدگی علوم در صورتیکه در حجم عظیمی از دادهها تمایل به کارهای تحقیقاتی به صورت دستی داشتهباشیم این کار زمانگیر و گاهی غیر ممکن میباشد لذا استفاده از روشی که به صورت اتوماتیک این کارهای تحقیقاتی را انجام دهد میتواند مفید باشد در این مقاله الگوریتمی برای رتبه بندی BM25 در متون غیرساخت یافته با استفاده از تطبیق مفاهیم در زبان فارسی ارائه شده است و سپس نتیجه آن در بازیابی اطلاعات با الگوریتمهای BM25 استاندارد ،مورد ارزیابی قرار گرفته است استفاده از این الگوریتم در متون فارسی و همچنین متونی که شامل ترکیبی از زبانهای فارسی و لاتین باشد گاهی به دلیل برخی مسائل باعث کاهش دقت، صحت و بازخوانی این الگوریتم میگردد الگوریتم ارائه شده با استفاده از قواعد ساختواژی زبان فارسی و استفاده از مجموعه لغات برای جلوگیری از ایجاد ریشههای نادرست، بهریشهیابی کلمات میپردازد
کلیدواژهها
نویسندگان
شیوه ارجاع
�گبی، مسعود و امینی لاری، منصور،1394،استفاده از الگوریتم رتبه بندی BM25 و بهبود آن در متون غیرساخت یافته با استفاده ازتطبیق مفاهیم،کنفرانس بین المللی یافته های نوین پژوهشی درمهندسی برق و علوم کامپیوتر،تهران
ارائهشده در
مجموعه مقالات سومین کنفرانس ملی محاسبات نرم علوم مهندسی در صنعت و جامعه1 اسفند 1402 · ایرانشهر