جمعه 1 فروردین 1404 – 17:48
نئووین مینویسد که این شرکت در ماههای گذشته ابزارهای متعددی نظیر Operator، Deep Research، Computer-Using Agents و Responses API را معرفی کرده بود که همگی بر عاملهای متنی تمرکز داشتند. اما اکنون با ارائه مدلهای صوتی gpt-4o-transcribe و gpt-4o-mini-transcribe، OpenAI گام بلندی به سوی توسعه عاملهای صوتی برداشته است.
علاوه بر این، مدل gpt-4o-mini-tts بهعنوان جدیدترین مدل تبدیل متن به گفتار معرفی شده که توانایی هدایتپذیری بالاتری دارد. توسعهدهندگان اکنون میتوانند شیوه بیان متن را بهطور مستقیم به مدل اعلام کنند. هرچند فعلاً این مدل فقط از صداهای مصنوعی از پیش تعیینشده پشتیبانی میکند.
برای مشاهده کامل مطب کلیک کنید
