این سایت در حال حاضر پشتیبانی نمی شود و امکان دارد داده های نشریات بروز نباشند
صفحه اصلی
درباره پایگاه
فهرست سامانه ها
الزامات سامانه ها
فهرست سازمانی
تماس با ما
JCR 2016
جستجوی مقالات
جمعه 28 آذر 1404
پردازش علائم و داده ها
، جلد ۹، شماره ۱، صفحات ۳۵-۴۸
عنوان فارسی
روشی جدید در بازشناسی مقاوم گفتار مبتنی بر دادگان مفقود با استفاده از شبکه عصبی دوسویه
چکیده فارسی مقاله
عملکرد سیستم های بازشناسی گفتار زمانی که گفتار توسط نویز تخریب شده باشد، به شدت کاهش می یابد. یکی از روش های رایج برای مقاوم سازی سیستم های بازشناسی گفتار استفاده از روش دادگان مفقود است در این روش مؤلفههایی از نمایش زمانی- فرکانسی گفتار (اسپکتروگرام) که نسبت سیگنال به نویز (SNR) آنها از یک آستانه کمتر است، بعنوان مؤلفه های نامعتبر یا مفقود برچسب دهی می شوند. این مؤلفه ها با استفاده از مؤلفه های معتبر و اطلاعات آماری که نسبت به دادگان تمیز، تخمین زده شده و جایگزین می شوند. در این مقاله الگوی ویژگی های مفقود با دیدگاهی نو به عنوان مسئله جبران سازی دادگان مطرح می شود. به اینصورت که با استفاده از شبکه عصبی دوسویه و انجام یک سری پردازشهای غیرخطی و دوطرفه (جلوسو و برگشتی) از دانش نهفته در مدل، ناشی از یادگیری هم-زمان گفتار تمیز و نویزی بهره گرفته، بردارهای بازنمایی گفتار در جهت افزایش صحت بازشناسی آواها بهبود می یابند. در این روش نیازی به شناسایی مؤلفههای مفقود که یک بحث چالش برانگیز در حوزه بازشناسی مقاوم گفتار مبتنی بر دادگان مفقود است نمی باشد بلکه بازسازی در جهت هرچه شبیه تر شدن تمامی مؤلفهها (خواه معتبر باشد خواه نامعتبر) به مؤلفههای گفتار تمیز صورت می گیرد و این یک برتری بسیار چشمگیری است که در این تحقیق حاصل شده است؛ نتایج مقایسه این دو روش نشان می دهد که با استفاده از روش دادگان مفقود، 2/4 درصد بهبود برای صحت بازشناسی گفتار نویزی با نسبت سیگنال به نویز dB0 حاصل شده درحالیکه با استفاده از روش مبتنی بر شبکه عصبی دوسویه، 5/8 درصد بهبود برای همان نسبت سیگنال به نویز به دست آمده است.
کلیدواژههای فارسی مقاله
بازشناسی مقاوم گفتار، دادگان مفقود، شبکه عصبی دوسویه
عنوان انگلیسی
New Approach in Robust Speech Recognition Based on Missing Feature using Bidirectional Neural Network
چکیده انگلیسی مقاله
Performance of speech recognition systems is greatly reduced when speech corrupted by noise. One common method for robust speech recognition systems is missing feature methods. In this way, the components in time - frequency representation of signal (Spectrogram) that present low signal to noise ratio (SNR), are tagged as missing and deleted then replaced by remained components and statistical information of clean speech. In this article a new approach of missing features method based on compensation are proposed. A Bidirectional Neural Network (BNN) was developed and implemented in order to modify unreliable components in input feature vectors and improve the overall recognition accuracy. Distorted components in feature vectors were estimated in accordance with the latent knowledge in the hidden layer of the neural network. This knowledge is obtained by training with clean and noisy speech, simultaneously and is mostly induced by reliable and less influenced components by the irrelevant variations in speech signal. In this approach, there is no need to identify missing components that is a challenging issue in the field of robust speech recognition based on missing feature method because reconstruction is done on all components (whether reliable or unreliable), in order to become more similar to the clean speech component. This point is a very significant advantage that has been achieved in this article. Comparing the results of these two methods shows that using Missing feature methods, 4.2% improvement were obtained in the accuracy of speech recognition for noisy signal by SNR=0dB, whereas improvement value increased to 8.5%, using bidirectional neural network for the same signal to noise ratio.
کلیدواژههای انگلیسی مقاله
نویسندگان مقاله
حجت محمدنژاد | hojat mohammadnejad
پژوهشگاه مخابرات و الکترونیک فجر
منصور ولی | mansour vali
دانشگاه خواجه نصیر
نشانی اینترنتی
http://jsdp.rcisp.ac.ir/browse.php?a_code=A-10-1362-1&slc_lang=fa&sid=1
فایل مقاله
اشکال در دسترسی به فایل - ./files/site1/rds_journals/1315/article-1315-600124.pdf
کد مقاله (doi)
زبان مقاله منتشر شده
fa
موضوعات مقاله منتشر شده
مقالات پردازش گفتار
نوع مقاله منتشر شده
پژوهشی
برگشت به:
صفحه اول پایگاه
|
نسخه مرتبط
|
نشریه مرتبط
|
فهرست نشریات