یکشنبه 18 خرداد 1404 – 11:05
تکناک
این حالت پیشرفته، مبتنی بر مدلهای چندوجهی بومی مانند GPT-4o عمل میکند و توانایی دارد در زمانی کمتر از ۲۳۲ میلیثانیه به ورودیهای صوتی پاسخ دهد؛ زمانی که از میانگین گفتوگوی انسانی نیز فراتر نمیرود. از ویژگیهای برجسته این سیستم، درک نشانههای غیرکلامی مانند سرعت صحبت کردن کاربر و واکنش نشان دادن با لحن احساسی است.
برای مشاهده کامل مطب کلیک کنید
