٠٣ مهر ١٣٨٩
![]()
چکیده:
مقدمه:
پیشرفت های تکنیکی در فرآیند های سیگنالی موجب پیشبرد تکنولوژی های کلامی میشود، که بسیاری از آنها کاربردی و تجاری است. صداشناسی اتوماتیک، تشخیص صدا و سیستم های ترکیب گفتار نمونه هایی از چنین تکنولوژی هایی بوده که میتوانند به طور کاملاً مفیدی در قسمت هایی همچون، تلفن بانک و فعالیتهای اطلاعات کامپیوتری به کار روند. علی رغم سیستم های جاری، پیچیدگی های سیستمها، اعتبارات و سودمندی آنها به عواملی همچون تأثیری که بر گفتار دارد، حالات گذرا، تغییراتی که بر گوینده دارد، ازقبیل استرس فیزیولوژیکی، حالات حسی و نگرش گوینده محدود میشود. تحقیق های قبلی نشان میدهند که این تغییرات در حالات گوینده سیگنالهای کلامی شنیداری را به روش های خاص و پایداری تغییر میدهد. چنین دانشی در تغییرحالات گوینده و تکنولوژی تشخیص صدا منجر به سیستم های قدرتمندی میشود که حاصل انتخاب پارامترها و الگوریتم های پردازشی و نیز توسعه تکنیک های تولید کلام است که حالات گذرا را در گوینده کم میکند. سیستم ترکیب گفتار، که در حال حاضر محدود به صداهای غیرطبیعی است، از اطلاعات نگرشی و احساسی در شکل پارامترهای سوپراسگمنتال Suprasegmental و عروضیprosodic موجود است. همانطور که “مورای و آروت” میگویند، تولیدات بیشتر با کیفیت بالا در سیستم ترکیب گفتارهای احساسی نیازمند یک مدل کامل از فرآیند احساسی شامل اثرات سیستم های عصبی و تغییرات شنوایی است که البته چنین مدلی هنوز موجود نیست.
