تشخیص گوینده با شبکه های عصبی کانولوشنال و تئوری نتروسافیک | ||
| مدل سازی در مهندسی | ||
| دوره 21، شماره 75، زمستان 1402، صفحه 1-18 اصل مقاله (2.28 M) | ||
| نوع مقاله: مقاله پژوهشی | ||
| شناسه دیجیتال (DOI): 10.22075/jme.2023.29933.2409 | ||
| نویسندگان | ||
| صادق فدایی* 1؛ عبدالرضا رشنو2؛ عبدالصمد حمیدی2 | ||
| 1استادیار، دانشکده مهندسی، دانشگاه یاسوج،یاسوج، ایران | ||
| 2استادیار، دانشکده مهندسی، دانشگاه لرستان، خرم آباد، ایران | ||
| چکیده | ||
| تشخیص گوینده، فرآیند تشخیص افراد بر اساس صوت آنها است که در کاربردهای زیادی مورد استفاده قرار میگیرد. اگرچه تاکنون تحقیقات زیادی در زمینهی تشخیص گوینده صورت گرفته است، اما چالشهایی وجود دارد که هنوز حل نشدهاند. در این مقاله به منظور بهبود دقت سیستمهای تشخیص گوینده از نتروسافیک و شبکههای عصبی کانولوشنال بهره گرفته شده است. در روش پیشنهادی، ابتدا اسپکتروگرام سیگنال صوتی تشکیل میگردد سپس اسپکتروگرام به فضای نتروسافیک منتقل میشود. در مرحلهی بعد عملگرهای بهبود بتا به مجموعههای نتروسافیک اعمال میشود و این عملیات تا ثابت شدن آنتروپی مجموعههای نتروسافیک تکرار میگردد. در نهایت یک مدل شبکهی عصبی کانولوشنال برای طبقهبندی هیستوگرام پیشنهاد میشود. برای ارزیابی و تحلیل روش پیشنهادی از دو پایگاه دادهی Aurora2 و TIMIT استفاده شده است. روش پیشنهادی روی پایگاه دادهی Aurora2 به دقت 79/93 درصد و روی پایگاه دادهی TIMIT به دقت 24/95 درصد دست یافته است که در مقایسه با روشهای رقیب عملکرد بهتری داشته است. | ||
| کلیدواژهها | ||
| اسپکتروگرام؛ تشخیص گوینده؛ نتروسافیک؛ شبکه ی عصبی کانولوشنال | ||
| مراجع | ||
|
| ||
|
آمار تعداد مشاهده مقاله: 1,267 تعداد دریافت فایل اصل مقاله: 985 |
||
| تعداد نشریات | 22 |
| تعداد شمارهها | 722 |
| تعداد مقالات | 10,383 |
| تعداد مشاهده مقاله | 72,840,483 |
| تعداد دریافت فایل اصل مقاله | 64,537,260 |