چکیده مقاله
با گسترش استفاده ی دستگاه های دیجیتال، بخصوص رایانه ها، تولید و بکارگیری متن دیجیتال در رایانه، زبان فارسی را با چالش های جدیدی روبرو کرده است تولید و استفاده از متون رقمی در رایانه، مستلزم بکارگیری ابزارهای پردازش زبان طبیعی است انجام پژوهش در حوزه ی پردازش زبان طبیعی برای فارسی، نیازمند پیش نیازهایی مانند منابع زبانی، پیکره ها و ابزارهای پردازش زبان است عدم دسترسی به پیش نیازهای تحقیق، موجب عقب ماندگ یهای بسیاری در حوزه ی پردازش زبان طبیعی شده است حال آنکه بیش از 1% از جمعیت جهان فارسی زبانند و بیش از 134 میلیون نفر در جهان زبان فارسی را به عنوان زبان اول یا دوم صحبت می کنند و چنین کمبودهایی مسلما آزار دهنده و مشکل سازا است برای رفع این مشکلات در این پژوهش راه کارهایی مبتنی بر تولید دانش برای تهیه منابع و رفع پیش نیازهای تحقیق در حوزه ی زبان فارسی ارایه می شود در همین راستا یک پیکره یک زبانه از متن مقالات فارسی تهیه شده و برپایه ی آن یک دیکشنری از واژگان صحیح فارسی ساخته می شود با استفاده از این منابع ابزار تجزیه کننده متن، غلط یاب لغوی و پیکره ی مجموعه ی ابهام واژگان فارسی نیز تولید می شود
کلیدواژهها
نویسندگان
شیوه ارجاع
�ستغیب، محمدباقر،1397،تولید پیکره متنی برای زبان فارسی با استفاده از راه حل های مبتنی بر دانش،چهارمین کنفرانس ملی دستاوردهای نوین در برق و کامپیوتر و صنایع،اسفراین
ارائهشده در
مجموعه مقالات چهارمین کنفرانس ملی دستاوردهای نوین در برق و کامپیوتر و صنایع18 مهر 1397 · اسفراین