انویدیا راهی ساده برای کاهش هزینه هوش مصنوعی پیدا کرد

شرکت انویدیا با معرفی فناوری انتقال میان‌مدلی KV Cache، راهکاری مبتنی بر ریاضیات خطی ارائه کرده است که می‌تواند بدون پردازش دوباره مکالمات، جابه‌جایی بین مدل‌های هوش مصنوعی را تا ۲۵ برابر سریع‌تر و ارزان‌تر کند.

شنبه 31 مرداد 1405 – 12:25انویدیا راهی ساده برای کاهش هزینه هوش مصنوعی پیدا کردشرکت انویدیا با معرفی فناوری انتقال میان‌مدلی KV Cache، راهکاری مبتنی بر ریاضیات خطی ارائه کرده است که می‌تواند بدون پردازش دوباره مکالمات، جابه‌جایی بین مدل‌های هوش مصنوعی را تا ۲۵ برابر سریع‌تر و ارزان‌تر کند.مدل‌های هوش مصنوعی

به‌ گزارش سرویس هوش مصنوعی تک‌ناک، در سیستم‌های هوش مصنوعی، زمانی که یک وظیفه میان مدل‌های مختلف جابه‌جا می‌شود، هزینه پنهانی سنگینی ایجاد می‌شود. برای مثال، وقتی یک مدل کوچک‌تر کاری را به یک مدل قدرتمندتر واگذار می‌کند یا پس از پایان پردازش دوباره به مدل ارزان‌تر بازمی‌گردد، مدل مقصد باید کل تاریخچه مکالمه را از ابتدا پردازش کند. این بازپردازش کامل، مصرف منابع محاسباتی و زمان پاسخ‌دهی را افزایش می‌دهد و به یک گلوگاه جدی برای شرکت‌هایی تبدیل شده است که روی گردش‌های کاری طولانی‌مدت و چندمدلی هوش مصنوعی کار می‌کنند.

بیشتر بخوانید: رشد OpenAI در بین کاربران سازمانی آمریکا سریع‌تر شد

منبع  : تک ناک

برای مشاهده کامل مطب کلیک کنید

 

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *