مروری بر روش های شناسایی گوینده با تاکید بر رویکردهای نوین

سال انتشار: 1403
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 191

فایل این مقاله در 14 صفحه با فرمت PDF قابل دریافت می باشد

استخراج به نرم افزارهای پژوهشی:

لینک ثابت به این مقاله:

شناسه ملی سند علمی:

SETT10_021

تاریخ نمایه سازی: 7 بهمن 1403

چکیده مقاله:

شناسایی گوینده یکی از چالش های مهم و کاربردی در حوزه پردازش گفتار است که نقش بسزایی در امنیت، احراز هویت صوتی، و سیستم های هوشمند ایفا می کند. این مقاله به بررسی روش های نوین شناسایی گوینده می پردازد و پیشرفت های اخیر در این حوزه را تحلیل می کند. تمرکز اصلی مقاله بر روی معرفی و تحلیل تکنیک های مدرن یادگیری عمیق است، از جمله شبکه های عصبی کانولوشنی (CNN) و مدل های ترکیبی که توانایی استخراج و تحلیل ویژگی های پیچیده تر سیگنال گفتار را دارند. این روش ها در شناسایی گوینده مستقل از متن و در شرایط نویزی یا غیرایده آل کاربردهای فراوانی دارند. در نهایت، چالش های باقی مانده، محدودیت های موجود، و مسیرهای تحقیقاتی آتی برای توسعه سیستم های دقیق تر و پایدارتر بررسی می شود. این مطالعه می تواند به محققان و توسعه دهندگان در جهت گیری بهتر در این زمینه کمک شایانی کند.

نویسندگان

علی اعظم

دانشجوی کارشناسی ارشد دانشگاه صداوسیمای جمهوری اسلامی ایران

معصومه شفیعیان

عضو هیئت علمی دانشگاه صداوسیمای جمهوری اسلامی ایران