ترفند محققان علی‌بابا برای کاهش چشمگیر مصرف GPU برای ابر‌هایی که چندین مدل ارائه می‌دهند

محققان شرکت علی‌بابا از راهکار نوآورانه‌ای با نام Aegaeon رونمایی کرده‌اند که طبق اعلام آنها می‌تواند میزان استفاده از پردازنده‌های گرافیکی انویدیا (GPU) را تا ۸۲ درصد کاهش دهد. این سیستم با هدف بهینه‌سازی منابع محاسباتی برای مدل‌های هوش مصنوعی طراحی شده و طی بیش از سه ماه در بازار مدل‌های ابری علی‌بابا کلود به‌صورت آزمایشی مورد استفاده قرار گرفته است.

محققان شرکت علی‌بابا از راهکار نوآورانه‌ای با نام Aegaeon رونمایی کرده‌اند که طبق اعلام آنها می‌تواند میزان استفاده از پردازنده‌های گرافیکی انویدیا (GPU) را تا ۸۲ درصد کاهش دهد. این سیستم با هدف بهینه‌سازی منابع محاسباتی برای مدل‌های هوش مصنوعی طراحی شده و طی بیش از سه ماه در بازار مدل‌های ابری علی‌بابا کلود به‌صورت آزمایشی مورد استفاده قرار گرفته است.

به گزارش پیوست به نقال SCMP، گزارش ارائه‌شده در سی و یکمین سمپوزیوم اصول سیستم‌های عامل (SOSP) در سئول، راهکار Aegaeon به توسعه دهنده هوش مصنوعی یا ارائه دهنده ابری این امکان را می‌دهد تا GPUهای مورد نیاز برای اجرای ده‌ها مدل زبانی تا ۷۲ میلیارد پارامتر را از ۱۱۹۲ عدد به تنها ۲۱۳ عدد کاهش دهد. پژوهشگران دانشگاه پکن و علی‌بابا کلود طی مقاله‌ای علمی اعلام کردند که این فناوری برای نخستین‌بار هزینه‌های پنهان و سنگین ناشی از سرویس‌دهی هم‌زمان به مدل‌های بزرگ زبانی را آشکار کرده است.

به گفته زهو جینگرن، مدیر ارشد فناوری علی‌بابا کلود و یکی از نویسندگان مقاله، هدف اصلی از توسعه Aegaeon افزایش بهره‌وری در زیرساخت‌های ابری و کاهش اتلاف منابع در زمان اجرای مدل‌های هوش مصنوعی است. بخش ابری علی‌بابا در روز پنج‌شنبه اعلام کرد که این راهکار اکنون به‌صورت رسمی در بازار مدل‌های خود با نام Bailian پیاده‌سازی شده و مدل‌های زبانی اختصاصی شرکت مانند Qwen را از این طریق در اختیار کاربران سازمانی می‌گذارد.

منبع  : ماهنامه پیوست

برای مشاهده کامل مطلب کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *