چکیده مقاله
بازشناسی گفتار یکی از فناوری های مهم هوش مصنوعی است که وظیفه آن تبدیل صدای انسان به متن قابل پردازش توسط رایانه است این فناوری با ترکیبی از پردازش سیگنال، مدل های آکوستیکی و مدل های زبانی کار می کند و طی سال های اخیر با استفاده از شبکه های عصبی و معماری های عمیق، دقت و سرعت آن به طور قابل توجهی افزایش یافته است در این فرایند، گفتار خام ابتدا به ویژگی های قابل تحلیل تبدیل می شود و سپس مدل هوش مصنوعی ساختار کلمات و جملات را بازسازی می کند سیستم های جدید End to End مانند Whisper و wav۲vec این مراحل را به صورت یکپارچه انجام می دهند و عملکرد بسیار بهتری در محیط های واقعی ارائه می دهند بازشناسی گفتار امروزه کاربرد گسترده ای در دستیارهای صوتی، خودروهای هوشمند، زیرنویس خودکار، ترجمه گفتاری، پزشکی و ابزارهای دسترس پذیری دارد با وجود چالش هایی مانند نویز، تفاوت لهجه ها و محدودیت داده های زبانی، روند توسعه این فناوری نشان می دهد که در آینده دقت آن به سطح درک انسان نزدیک خواهد شد
کلیدواژهها
نویسندگان
شیوه ارجاع
در صورتی که می خواهید در اثر پژوهشی خود به این مقاله ارجاع دهید، به سادگی می توانید از عبارت زیر در بخش منابع و مراجع استفاده نمایید: کرکه آبادی، مجتبی و آزادی، محمد و شاهسون، مهناز،1404،بازنشناسی گفتار در هوش مصنوعی،نهمین کنفرانس بین المللی پژوهش های کاربردی در علوم و مهندسی،https://civilica.com/doc/2606433
ارائهشده در
مجموعه مقالات نهمین کنفرانس بین المللی پژوهش های کاربردی در علوم و مهندسی7 اسفند 1404