رونمایی OpenAI از مدل‌های صوتی نسل جدید

جمعه 1 فروردین 1404 – 17:48رونمایی شرکت OpenAI از مدل‌های صوتی نسل جدید برای ساخت دستیارهای صوتی پیشرفته

نئووین می‌نویسد که این شرکت در ماه‌های گذشته ابزارهای متعددی نظیر Operator، Deep Research، Computer-Using Agents و Responses API را معرفی کرده بود که همگی بر عامل‌های متنی تمرکز داشتند. اما اکنون با ارائه مدل‌های صوتی gpt-4o-transcribe و gpt-4o-mini-transcribe، OpenAI گام بلندی به سوی توسعه عامل‌های صوتی برداشته است.

علاوه بر این، مدل gpt-4o-mini-tts به‌عنوان جدیدترین مدل تبدیل متن به گفتار معرفی شده که توانایی هدایت‌پذیری بالاتری دارد. توسعه‌دهندگان اکنون می‌توانند شیوه بیان متن را به‌طور مستقیم به مدل اعلام کنند. هرچند فعلاً این مدل فقط از صداهای مصنوعی از پیش تعیین‌شده پشتیبانی می‌کند.

منبع  : تک ناک

برای مشاهده کامل مطب کلیک کنید

 

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *