پنجشنبه 18 تیر 1405 – 09:15
شرکت OpenAI با معرفی مدلهای صوتی جدید ChatGPT تلاش کرده است مکالمههای صوتی را طبیعیتر، طولانیتر و تعاملیتر کند.
به گزارش سرویس هوش مصنوعی تکناک، این مدلها که با نامهای GPT-Live-1 و GPT-Live-1 mini معرفی شدند، صدای طبیعیتری دارند و در مدیریت رفتوبرگشت مکالمات، عملکرد بهتری ارائه میدهند. این مدلها از معماری کاملا دوطرفه بهره میبرند؛ به این معنا که میتوانند همزمان به صحبتهای کاربر گوش دهند و پاسخ صوتی ارائه کنند. چنین قابلیتی امکان قطع کردن طبیعی صحبت هوش مصنوعی توسط کاربر و ویژگیهایی مانند ترجمه زنده را فراهم میکند. همچنین شرکت OpenAI بیان کرد که حالت فعلی Advanced Voice Mode در ChatGPT به صورت پیشفرض با مدل GPT-Live-1 mini جایگزین خواهد شد. کاربران سرویسهای پولی ChatGPT نیز به مدل قدرتمندتر GPT-Live-1 دسترسی خواهند داشت. نسل قبلی حالت صوتی ChatGPT برای فعالیت خود به ترکیبی از سه مدل مجزا متکی بود، که شامل مدل تبدیل گفتار به متن برای پردازش صحبت کاربر، مدل زبانی بزرگ برای تولید پاسخ و مدل تبدیل متن به گفتار برای خواندن پاسخ نهایی بودند.
برای مشاهده کامل مطب کلیک کنید
