بهبود کارایی یک سیستم تشخیص احساس از گفتار به کمک شبکه مولد متخاصمی جهت کاربرد در روانشناسی بالینی

نویسنده:

آرش شیلاندری* ، حسین خسروی ، حسین مروی

پیام:

نوع مقاله:

مقاله پژوهشی/اصیل (دارای رتبه معتبر)

چکیده:

مقدمه

فناوری تشخیص احساس از گفتار، می تواند به محققان کمک کند تا دریابند چه عواملی باعث می شود برخی از روان درمانگران درمان موثرتری نسبت به دیگران ارایه دهند، اطلاعاتی که می تواند برای بهبود تشخیص روش درمان استفاده شود. اگر بدانیم چه کسی می خواهد اقدام به خودکشی کند یا حداقل ریسک بالایی برای این کار دارد می توانیم پیشگیری کنیم و این دقیقا همان چیزی است که علم روانشناسی سال هاست به آن نیاز دارد تا هزینه های درمان را کاهش دهد. ازاین رو، نیاز به تشخیص احساس از گفتار و پایگاه داده احساسی به شدت احساس می شود؛ ولی جمع آوری پایگاه داده با نمونه های زیاد نیازمند صرف چندین دهه است. افزایش داده و انتخاب ویژگی، از مفاهیم کلیدی در یادگیری ماشین هستند.

روش

هنگامی که داده های آموزشی در پایگاه داده متنوع نیستند و تعداد و تنوع آن ها در هر کلاس آموزشی محدود است، آموزش یک شبکه عصبی عمیق بدون آنکه پدیده اور فیتینگ اتفاق بیفتد، بیش از حد چالش برانگیز است. برای غلبه بر این چالش، این مقاله یک شبکه افزایش داده جدید، یعنی شبکه افزایش داده متخاصمانه و مبتنی بر شبکه های مولد متخاصمی را پیشنهاد می کند. این شبکه افزایش داده پیشنهادی، از یک شبکه مولد متخاصمی، یک رمزگذار خودکار و یک طبقه بند تشکیل شده است. این شبکه ها به طور خصمانه آموزش داده می شوند تا بردارهای ویژگی وابسته به هر کلاس را در فضای ویژگی ها ترکیب کنند، و سپس آن ها را به داده های موجود در پایگاه داده بیفزایند. برای داده های هر کلاس به صورت جداگانه یک شبکه مولد متخاصمی پیشنهاد شده است که از یک سو شباهت بین نمونه های واقعی و تولید شده را تضمین کند و از طرف دیگر باعث ایجاد تمایز عاطفی در بین نمونه های تولید شده بین کلاس های مختلف شود. برای رفع مشکل کوچک شدن بیش از حد گرادیان در فرایند آموزش شبکه افزایش داده متخاصمی که منجر به عدم آموزش کافی شبکه های مولد و تشخیص دهنده و متوقف شدن فرایند آموزش پیش از یادگیری کامل توزیع داده ها در فضای ویژگی ها می شود، به جای استفاده از خطای متداول آنتروپی متقابل برای آموزش شبکه مولد متخاصمی، واگرایی و اسراستین برای تولید نمونه های مصنوعی باکیفیت بالا استفاده شده است.

یافته ها

عملکرد این مدل با استفاده از پایگاه داده احساسی برلین به عنوان مجموعه داده های آموزش، تست و ارزیابی شبکه مورد آزمایش قرار گرفته و مشخص شد که با ترکیب نمودن بردارهای ویژگی مصنوعی و بردارهای ویژگی واقعی، می توان مشکل کوچک شدن بیش از حد گرادیان و متعاقبا متوقف شدن ادامه روند آموزش شبکه را تا حد زیادی کاهش داد. نتایج به دست آمده نشان می دهد که داده های تولید شده توسط شبکه پیشنهادی می توانند در یک شبکه تشخیص احساس از سیگنال گفتار استفاده شوند و به این شبکه کمک کنند تا کلاسه بندی احساسی بهتری را انجام دهد.

کلیدواژگان:

پردازش گفتار ، انتخاب ویژگی ، افزایش داده ، تشخیص احساس از گفتار ، شبکه های مولد متخاصمی

زبان:

فارسی

انتشار در:

فصلنامه روان شناسی بالینی، سال پانزدهم شماره 1 (پیاپی 57، بهار 1402)

صفحات:

53 تا 67

لینک کوتاه:

magiran.com/p2664723

دانلود و مطالعه متن این مقاله با یکی از روشهای زیر امکان پذیر است:

اشتراک شخصی

با عضویت و پرداخت آنلاین حق اشتراک یک‌ساله به مبلغ 1,390,000ريال می‌توانید 70 عنوان مطلب دانلود کنید!

اشتراک سازمانی

به کتابخانه دانشگاه یا محل کار خود پیشنهاد کنید تا اشتراک سازمانی این پایگاه را برای دسترسی نامحدود همه کاربران به متن مطالب تهیه نمایند!

اطلاعات بیشتر

توجه!

حق عضویت دریافتی صرف حمایت از نشریات عضو و نگهداری، تکمیل و توسعه مگیران می‌شود.
پرداخت حق اشتراک و دانلود مقالات اجازه بازنشر آن در سایر رسانه‌های چاپی و دیجیتال را به کاربر نمی‌دهد.

In order to view content subscription is required

Personal subscription

Subscribe magiran.com for 70 € euros via PayPal and download 70 articles during a year.

Organization subscription

Please contact us to subscribe your university or library for unlimited access!

More information

علمی مصوب

فصلنامه روان شناسی بالینی

Journal of Clinical Psycology

فصلنامه علوم انسانی

آخرین شماره | آرشیو

ISSN: 2008-501X eISSN: 2228-5180

صاحب امتیاز:

دانشگاه سمنان

مدیر مسئول:

ایمان بیگدلی

سردبیر:

دکتر شاهرخ مکوند حسینی

تلفن نشریه: ۰۲۳-۳۳۶۲۹۵۶۷

اطلاعات بیشتر نشریه

درباره نشریه پیام به نشریه سایت اختصاصی نشریه پذیرش الکترونیکی مقاله راهنمای نویسندگان

سامانه نویسندگان

نویسنده (2)

خسروی، حسین

دانشیار دانشکده برق، دانشگاه صنعتی شاهرود

اطلاعات نویسنده(گان) توسط ایشان ثبت و تکمیل شده‌است. برای مشاهده مشخصات و فهرست همه مطالب، صفحه رزومه را ببینید.

به جمع مشترکان مگیران بپیوندید!

بهبود کارایی یک سیستم تشخیص احساس از گفتار به کمک شبکه مولد متخاصمی جهت کاربرد در روانشناسی بالینی

آرش شیلاندری* ، حسین خسروی ، حسین مروی

پردازش گفتار ، انتخاب ویژگی ، افزایش داده ، تشخیص احساس از گفتار ، شبکه های مولد متخاصمی

فصلنامه روان شناسی بالینی

Journal of Clinical Psycology