تکنیک جدید می‌تواند عملکرد مدل‌های زبانی را تا 300x تسریع کند

محققان در ETH زوریخ (موسسه فناوری فدرال زوریخ) تکنیک جدیدی را توسعه دادند که به طرز چشمگیری می‌تواند سرعت عملکرد شبکه‌های عصبی هوش مصنوعی را افزایش دهد. آن‌ها روند استنتاجی را ارائه کردند که میزان محاسبات این شبکه‌ها را بسیار کاهش می‌دهد.

محققان در ETH زوریخ (موسسه فناوری فدرال زوریخ) تکنیک جدیدی را توسعه دادند که به طرز چشمگیری می‌تواند سرعت عملکرد شبکه‌های عصبی هوش مصنوعی را افزایش دهد. آن‌ها روند استنتاجی را ارائه کردند که میزان محاسبات این شبکه‌ها را بسیار کاهش می‌دهد.

در آزمایشی که توسط BERT انجام شد، یک مدل تبدیل‌کننده در وظایف زبانی متنوع استخدام شد و محققان موفق شدند بیش از ۹۹ درصد از محاسبات را کاهش دهند. این تکنیک خلاقانه همچنین می‌تواند اعمال شود برای مدل‌های مبدلی که در مدل زبانی عظیم (LLM) مانند GPT-3 استفاده می‌شوند و امکان افزایش سرعت و کارآیی پروسه زبانی را ایجاد کند.

منبع  : ماهنامه پیوست

برای مشاهده کامل مطلب کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *