
یک مدل هوش مصنوعی جدید چینی که توسط استارتاپ مستقر در هانگژو ساخته شده، صنعت هوش مصنوعی آمریکا را با عملکردی بهتر از برخی از مدلهای پیشرو Open AI متحیر کرده است و حالا اپلیکیشن هوش مصنوعی DeepSeek، در صدر فهرست اپلیکیشن های محبوب فروشگاه های اندروید و آی او اس قرار دارد. همه اینها یک سوال حیاتی را مطرح می کند که علیرغم تحریمهای آمریکا علیه پکن برای دسترسی به نیمهرساناهای پیشرفته، آیا چین توانایی رقابت تنگاتنگ با آمریکا در زمینه هوش مصنوعی را دارد؟
هوش مصنوعی DeepSeek کمتر از دو سال پیش توسط High Flyer به عنوان یک آزمایشگاه تحقیقاتی اختصاص داده شده به حوزه هوش مصنوعی عمومی یا AGI تأسیس شد. مجموعهای از نسخههای متنباز از جمله مدل زبانی بزرگ “v3” که از همه LLMهای متنباز متا بهتر عمل کرد و با GPT4-o استارتاپ OpenAI به رقابت پرداخت، در اواخر سال ۲۰۲۴ این استارتاپ را بر سر زبانها انداختند.
از زمان تأسیس این شرکت در سال ۲۰۲۳، دیپسیک مجموعهای از مدلهای هوش مصنوعی مولد را منتشر کرده است و این شرکت با هر نسل جدید، تلاش کرده تا قابلیتها و عملکرد مدلهای خود را بهبود بخشد.
دیپسیک کُدِر (DeepSeek Coder): این مدل زبانی، اولین مدل متن باز هوش مصنوعی DeepSeek است که در ماه نوامبر 2023 و برای وظایفی مانند برنامه نویسی ساخته شد.
دیپسیک LLM (DeepSeek LLM): این مدل زبانی که در سال 2023 معرفی شد، اولین مدل چند منظوره دیپ سیک است.
دیپسیک-V2 (DeepSeek-V2): مدل زبانی V2، نسخه دوم LLM دیپ سیک است که به منظور کاهش هزینههای آموزش و عملکرد قویتر در ماه می سال 2024 معرفی شد.
دیپسیک-کُدِر-V2 (DeepSeek-Coder-V2): این مدل زبانی متشکل از 336 میلیارد پارامتر و طول متن 128000 است که برای تسهیل در حل کردن چالشهای برنامهنویسی ساخته شده است.
دیپسیک-V3 (DeepSeek-V3): مدل زبانی V3 بر مبنای معماری Mixture of Experts ساخته شده و قادر به انجام طیف گستردهای از وظایف است. این مدل زبانی دارای 671 میلیارد پارامتر و طول متن 128000 است.
دیپسیک-R1 (DeepSeek-R1): این مدل زبانی که در ماه ژانویه 2025 و براساس مدل V3 ساخته شده، بر وظایف مرتبط به استدلال تمرکز میکند. مدل R یکی از مهمترین رقبای مدل Open AI است که هزینه بسیار کمتری برای ساخت آن صرف شده است، اما دارای ۶۷۱ میلیارد پارامتر با طول متن ۱۲۸۰۰۰ است.
Janus-Pro-7B: این مدل زبانی در سال 2025 منتشر شد و یک مدل بصری است که میتواند تصاویر را درک کند و تصویر مورد نظر کاربر را تولید کند.
در لحظهای که گوگل، متا، مایکروسافت، آمازون و دهها رقیب این شرکت چینی آمادهاند تا دهها میلیارد دلار دیگر برای زیرساختهای جدید هوش مصنوعی هزینه کنند، موفقیت دیپسیک سؤال نگرانکنندهای را مطرح کرده است: آیا شرکتهای فناوری چینی میتوانند به طور بالقوه با صرف هزینه بسیار کمتر، با توانایی فنی خود برابری کنند یا حتی از آن فراتر روند؟
در حالی که دیپسیک R1 خبر خوبی برای کاربران و اقتصاد جهانی است، خبر بدی برای سهام فناوری ایالات متحده نیز محسوب میشود. این موضوع میتواند منجر به کاهش سرمایهگذاری در هوش مصنوعی و فشار بر حاشیههای سود شود. به ویژه، در شرایطی که انتظارات از ارزشگذاری و رشد این سهام بسیار بالا است.
در حال حاضر، مدل “o1 پرو” OpenAI همچنان پیشرفتهترین مدل در سطح جهانی محسوب میشود. با این وجود، عملکرد دیپسیک R1 نشان میدهد که چین در زمینه هوش مصنوعی بسیار سریعتر از آنچه تصور میشد، پیشرفت میکند و مدلهای متنباز تقریباً به سطح مدلهای بسته (Proprietary) رسیدهاند.
موفقیت دیپسیک زمانی بولدتر شد که اثربخشی استراتژی دولت ایالات متحده برای محدود کردن اکوسیستم هوش مصنوعی چین و محدود کردن صادرات تراشههای قدرتمند یا GPUها به پکن زیر سؤال رفت. اگر ادعاهای دیپسیک درست باشد، به این معناست که چین علیرغم این محدودیتها، توانایی ایجاد مدلهای هوش مصنوعی قدرتمند را دارد و محدودیتهای استراتژی ایالات متحده را بیاثر میکند.
