چهارشنبه 4 تیر 1404 – 07:39
مایکروسافت مدل زبانی جدیدی به نام Mu معرفی کرده است؛ یک LLM کوچکمقیاس با معماری encoder–decoder و حجم حدود ۳۳۰ میلیون پارامتر که بهصورت کاملاً محلی و روی NPU با سرعت بیش از ۱۰۰ توکن بر ثانیه اجرا می شود.
به گزارش تکناک، این مدل با بهینهسازی سختافزاری (استفاده از weight‑sharing، Grouped‑Query Attention، RoPE)، تأخیر پردازش را تا ۴۷٪ کاهش و سرعت رمزگشایی را تا ۴.۷ برابر افزایش داده است.
encoder-decoderواحد پردازش عصبی (NPU)Copilot+GPUهای A100Azure Machine LearningdistillationPhiCopilot+ PCsکمیسازیAMDIntelQualcommCopilot+encoder-decoder architectureکمیسازی
برای مشاهده کامل مطب کلیک کنید
