محققان شرکت علیبابا از راهکار نوآورانهای با نام Aegaeon رونمایی کردهاند که طبق اعلام آنها میتواند میزان استفاده از پردازندههای گرافیکی انویدیا (GPU) را تا ۸۲ درصد کاهش دهد. این سیستم با هدف بهینهسازی منابع محاسباتی برای مدلهای هوش مصنوعی طراحی شده و طی بیش از سه ماه در بازار مدلهای ابری علیبابا کلود بهصورت آزمایشی مورد استفاده قرار گرفته است.
به گزارش پیوست به نقال SCMP، گزارش ارائهشده در سی و یکمین سمپوزیوم اصول سیستمهای عامل (SOSP) در سئول، راهکار Aegaeon به توسعه دهنده هوش مصنوعی یا ارائه دهنده ابری این امکان را میدهد تا GPUهای مورد نیاز برای اجرای دهها مدل زبانی تا ۷۲ میلیارد پارامتر را از ۱۱۹۲ عدد به تنها ۲۱۳ عدد کاهش دهد. پژوهشگران دانشگاه پکن و علیبابا کلود طی مقالهای علمی اعلام کردند که این فناوری برای نخستینبار هزینههای پنهان و سنگین ناشی از سرویسدهی همزمان به مدلهای بزرگ زبانی را آشکار کرده است.
به گفته زهو جینگرن، مدیر ارشد فناوری علیبابا کلود و یکی از نویسندگان مقاله، هدف اصلی از توسعه Aegaeon افزایش بهرهوری در زیرساختهای ابری و کاهش اتلاف منابع در زمان اجرای مدلهای هوش مصنوعی است. بخش ابری علیبابا در روز پنجشنبه اعلام کرد که این راهکار اکنون بهصورت رسمی در بازار مدلهای خود با نام Bailian پیادهسازی شده و مدلهای زبانی اختصاصی شرکت مانند Qwen را از این طریق در اختیار کاربران سازمانی میگذارد.
