دوشنبه 7 اردیبهشت 1405 – 09:55
سرویس هوش مصنوعی تکناک
معماری NVFP4 در Blackwell نقش کلیدی در افزایش سرعت پردازش DeepSeek V4 ایفا میکند و طبق اعلام انویدیا، این تنها آغاز مسیر بهینهسازیها است. عرضه این نسخه با کاهش چشمگیر نیازهای محاسباتی و مصرف حافظه همراه بوده و کارایی کلی سیستم را به طور محسوسی ارتقا داده است.
بر اساس اطلاعات منتشرشده، DeepSeek-V4 برای استنتاج تکتوکن تنها به ۲۷ درصد از توان محاسباتی قبلی (FLOPs) نیاز دارد و در سناریوی پنجره متنی یک میلیون توکنی، مصرف KV Cache به ۱۰ درصد کاهش یافته است. انویدیا در این معرفی، عملکرد Blackwell را به عنوان زیرساختی کلیدی برای اجرای مدلهای عظیم و پردازشهای با زمینه طولانی، برجسته کرده است و تاکید دارد که این پردازندهها با تاخیر پایین، بستر لازم را برای اجرای مدلهای تریلیونپارامتری DeepSeek-V4 از همان روز نخست فراهم میکنند.
برای مشاهده کامل مطب کلیک کنید
