متا مدل جدید تبدیل گفتار به متن را معرفی کرد؛ تشخیص هم‌زمان بیش از ۲۰ گوینده

شفقنا رسانه- مدل جدید Muse Voice Transcribe می‌تواند گفتار بیش از ۲۰ نفر و بیش از ۲۰ زبان را به‌صورت هم‌زمان رونویسی کند.

شفقنا رسانه- مدل جدید Muse Voice Transcribe می‌تواند گفتار بیش از ۲۰ نفر و بیش از ۲۰ زبان را به‌صورت هم‌زمان رونویسی کند.

Muse Voice Transcribe اولین مدل پردازش صوتی بلادرنگ متا است و برای تبدیل گفتار به متن در حالت استریم طراحی شده است. این مدل قابلیت‌هایی مانند تفکیک گویندگان و تشخیص زمان پایان گفتار را در یک مدل واحد ارائه می‌کند.

منبع  : خبرگزاری بین اللملی شفقنا

برای مشاهده کامل مطلب کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *