معرفی هوش مصنوعی DeepSeek؛ آیا می‌تواند با مدل‌های برتر رقابت کند؟

یک مدل هوش مصنوعی جدید چینی که توسط استارتاپ مستقر در هانگژو ساخته شده، صنعت هوش مصنوعی آمریکا را با عملکردی بهتر از برخی از مدل‌های پیشرو Open AI متحیر کرده است و حالا اپلیکیشن هوش مصنوعی DeepSeek، در صدر فهرست اپلیکیشن های محبوب فروشگاه های اندروید و آی او اس قرار دارد. همه اینها یک سوال حیاتی را مطرح می کند که علیرغم تحریم‌های آمریکا علیه  پکن برای دسترسی به نیمه‌رساناهای پیشرفته، آیا چین توانایی رقابت تنگاتنگ با آمریکا در زمینه هوش مصنوعی را دارد؟

یک مدل هوش مصنوعی جدید چینی که توسط استارتاپ مستقر در هانگژو ساخته شده، صنعت هوش مصنوعی آمریکا را با عملکردی بهتر از برخی از مدل‌های پیشرو Open AI متحیر کرده است و حالا اپلیکیشن هوش مصنوعی DeepSeek، در صدر فهرست اپلیکیشن های محبوب فروشگاه های اندروید و آی او اس قرار دارد. همه اینها یک سوال حیاتی را مطرح می کند که علیرغم تحریم‌های آمریکا علیه  پکن برای دسترسی به نیمه‌رساناهای پیشرفته، آیا چین توانایی رقابت تنگاتنگ با آمریکا در زمینه هوش مصنوعی را دارد؟

هوش مصنوعی DeepSeek کمتر از دو سال پیش توسط  High Flyer به عنوان یک آزمایشگاه تحقیقاتی اختصاص داده شده به حوزه هوش مصنوعی عمومی یا AGI تأسیس شد. مجموعه‌ای از نسخه‌های متن‌باز از جمله مدل زبانی بزرگ “v3” که از همه LLMهای متن‌باز متا بهتر عمل کرد و با GPT4-o استارتاپ OpenAI به رقابت پرداخت، در اواخر سال ۲۰۲۴ این استارتاپ را بر سر زبان‌ها انداختند.

از زمان تأسیس این شرکت در سال ۲۰۲۳، دیپ‌سیک مجموعه‌ای از مدل‌های هوش مصنوعی مولد را منتشر کرده است و این شرکت با هر نسل جدید، تلاش کرده تا قابلیت‌ها و عملکرد مدل‌های خود را بهبود بخشد.

دیپ‌سیک کُدِر (DeepSeek Coder): این مدل زبانی، اولین مدل متن باز هوش مصنوعی DeepSeek است که در ماه نوامبر 2023 و برای وظایفی مانند برنامه نویسی ساخته شد.

دیپ‌سیک LLM (DeepSeek LLM): این مدل زبانی که در سال 2023 معرفی شد، اولین مدل چند منظوره دیپ سیک است.

دیپ‌سیک-V2 (DeepSeek-V2): مدل زبانی V2، نسخه دوم LLM دیپ سیک است که به منظور کاهش هزینه‌های آموزش و عملکرد قوی‌تر در ماه می سال 2024 معرفی شد.

دیپ‌سیک-کُدِر-V2 (DeepSeek-Coder-V2): این مدل زبانی متشکل از 336 میلیارد پارامتر و طول متن 128000 است که برای تسهیل در حل کردن چالش‌های برنامه‌نویسی ساخته شده است.

دیپ‌سیک-V3 (DeepSeek-V3): مدل زبانی V3 بر مبنای معماری Mixture of Experts ساخته شده و قادر به انجام طیف گسترده‌ای از وظایف است. این مدل زبانی دارای 671 میلیارد پارامتر و طول متن 128000 است.

دیپ‌سیک-R1 (DeepSeek-R1): این مدل زبانی که در ماه ژانویه 2025 و براساس مدل V3 ساخته شده، بر وظایف مرتبط به استدلال تمرکز می‌کند. مدل R یکی از مهم‌ترین رقبای مدل Open AI است که هزینه بسیار کمتری برای ساخت آن صرف شده است، اما دارای ۶۷۱ میلیارد پارامتر با طول متن ۱۲۸۰۰۰ است.

Janus-Pro-7B: این مدل زبانی در سال 2025 منتشر شد و یک مدل بصری است که می‌تواند تصاویر را درک کند و تصویر مورد نظر کاربر را تولید کند.

در لحظه‌ای که گوگل، متا، مایکروسافت، آمازون و ده‌ها رقیب این شرکت چینی آماده‌اند تا ده‌ها میلیارد دلار دیگر برای زیرساخت‌های جدید هوش مصنوعی هزینه کنند، موفقیت دیپ‌سیک سؤال نگران‌کننده‌ای را مطرح کرده است: آیا شرکت‌های فناوری چینی می‌توانند به طور بالقوه با صرف هزینه بسیار کمتر، با توانایی فنی خود برابری کنند یا حتی از آن فراتر روند؟

در حالی که دیپ‌سیک R1 خبر خوبی برای کاربران و اقتصاد جهانی است، خبر بدی برای سهام فناوری ایالات متحده نیز محسوب می‌شود. این موضوع می‌تواند منجر به کاهش سرمایه‌گذاری در هوش مصنوعی و فشار بر حاشیه‌های سود شود. به ویژه، در شرایطی که انتظارات از ارزش‌گذاری و رشد این سهام بسیار بالا است.

در حال حاضر، مدل “o1 پرو” OpenAI همچنان پیشرفته‌ترین مدل در سطح جهانی محسوب می‌شود. با این وجود، عملکرد دیپ‌سیک R1 نشان می‌دهد که چین در زمینه هوش مصنوعی بسیار سریع‌تر از آنچه تصور می‌شد، پیشرفت می‌کند و مدل‌های متن‌باز تقریباً به سطح مدل‌های بسته (Proprietary) رسیده‌اند.

موفقیت دیپ‌سیک زمانی بولدتر شد که  اثربخشی استراتژی دولت ایالات متحده برای محدود کردن اکوسیستم هوش مصنوعی چین و محدود کردن صادرات تراشه‌های قدرتمند یا GPUها به پکن زیر سؤال رفت. اگر ادعاهای دیپ‌سیک درست باشد، به این معناست که چین علیرغم این محدودیت‌ها، توانایی ایجاد مدل‌های هوش مصنوعی قدرتمند را دارد و محدودیت‌های استراتژی ایالات متحده را بی‌اثر می‌کند.

منبع  : مجله مایکت

برای مشاهده کامل مطلب کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *