چکیده مقاله
باتوجه به داده های عظیم موجود درپایگاه های داده اینترنت و مراکزاطلاعاتی طبقه بندی متن یک نقش مهم درسازمان دهی بازیابی و جستجوی اطلاعات موجود دراین پایگاه های داده می باشد درواقع می توان گفت طبقه بندی متن اختصاص دادن یک متن به یک طبقه ازپیش تعیین شده می باشد برایاختصاص یافتن یک متن به یک طبقه خاص ازویژگیهای متن موجود استفاده میشود و باتوجه به ویژگیهای فراوانی که برای متون وجود دارد یک چالش اساسی انخاب زیرمجموعه ای ازویژگیهای مناسب برای یک متن می باشد ازاین رو دراین مقاله ازفیلترهای مختلفی جهت انتخاب ویژگی ازجمله حذف کلمات متوقف کننده n gram و استفاده شده است دراین پژوهش ازمجموعه داده استاندارد خبرگزاری رویترز Reuters 21578 با8دسته مختلف و درمجموعه بیش از7000 سندمتنی استفاده شده است ازالگوریتم های ترکیبی جهت طبقه بندی استفاده کرده ایم که نتایج حاصل ازآزمایشها انجام شده برروی مجموعه داده نشان میدهد که الگوریتم پیشنهادی بهترین کارایی جهت طبقه بندی متن را داشته و باعث بهبود دقت و بازخوانی جهت طبقه بندی متن شده است باتوجه به نتایج شبیه سازی میزان دقت طبقه بندی اسناد برابر 96 66درصد شده است
کلیدواژهها
نویسندگان
شیوه ارجاع
�عیری، حدیث و شیری، ابراهیم،1395،بهبود دقت طبقهبندی اسناد با استفاده از ترکیب الگوریتمهای یادگیری ماشین،چهارمین کنفرانس بین المللی مهندسی برق و کامپیوتر،تهران
ارائهشده در
مجموعه مقالات چهارمین کنفرانس بین المللی مهندسی برق و کامپیوتر23 دی 1395 · تهران