چکیده مقاله
در فرآیند طبقه بندی متون Text Classification ، یک مشکل عمومی وجود دارد، که آن هم تعداد زیاد ویژگی های Features مسیله است به خاطر مدل های مختلف مانند کوله ای از کلمات Bag Of Words ، هر کلمه به یک بعد نگاشت می شود و به دلیل تعدد زیاد کلمات یکتا در یک انباره ی متنی، حجم مدل، بسیار بزرگ می شود برای مقابله با این مشکل یک روش عمومی به نام انتخاب ویژگی Feature Selection وجود دارد در روش های انتخاب ویژگی، یک زیر مجموعه ای از کلمات موجود، به عنوان کلمات ارزشمند در طبقه بندی، شناسایی می شوند و بقیه ی کلمات، که ارزش زیادی در طبقه بندی ندارند و در اصلاح اطلاعات زیادی ندارد ، بایستی حذف شده و در فرآیند طبقه بندی استفاده نشوند در این مقاله سعی شده، روش ها و متدولوژی های مختلف انتخاب ویژگی بررسی شوند، و یک روش پیشنهادی جهت استخراج ویژگی از متون خبری کلان، ارایه شود
کلیدواژهها
نویسندگان
شیوه ارجاع
کاویانی، مسعود و ندیمی، محمد،1395،ارایه یک مدل پیشنهادی جهت استخراج ویژگی از نوشتارهای کلان،کنفرانس بین المللی مهندسی و علوم کامپیوتر،نجف آباد
ارائهشده در
مجموعه مقالات دومین کنفرانس بین المللی مهندسی و علوم کامپیوتر29 آذر 1401 · نجف آباد