شرکت علی‌بابای چین از نسخه جدید مدل متن‌باز Qwen3 رونمایی کرد

در شرایطی که رقابت میان مدل‌های هوش مصنوعی روز به‌روز داغ‌تر می‌شود، علی‌بابا با عرضه نسخه جدیدی از مدل زبانی Qwen3، بار دیگر توجه تحلیل‌گران، پژوهشگران و توسعه‌دهندگان در سراسر جهان را به خود جلب کرده است. این مدل جدید که نام کامل آن Qwen3-235B-A22B-Instruct-2507 به صورت متن‌باز در پلتفرم هاگینگ‌فیس عرضه شده و بهبود چشمگیر عملکرد، معماری نوین و مجوز تجاری استفاده تجاری، نه‌تنها جایگاه چین در توسعه LLM را تثبیت می‌کند، بلکه چالشی جدی برای مدل‌های قدرتمند شرکت‌هایی چون اوپن‌ای‌آی، انتروپیک و گوگل است که بر رویکرد بسته و انحصاری تمرکز دارند.

در شرایطی که رقابت میان مدل‌های هوش مصنوعی روز به‌روز داغ‌تر می‌شود، علی‌بابا با عرضه نسخه جدیدی از مدل زبانی Qwen3، بار دیگر توجه تحلیل‌گران، پژوهشگران و توسعه‌دهندگان در سراسر جهان را به خود جلب کرده است. این مدل جدید که نام کامل آن Qwen3-235B-A22B-Instruct-2507 به صورت متن‌باز در پلتفرم هاگینگ‌فیس عرضه شده و بهبود چشمگیر عملکرد، معماری نوین و مجوز تجاری استفاده تجاری، نه‌تنها جایگاه چین در توسعه LLM را تثبیت می‌کند، بلکه چالشی جدی برای مدل‌های قدرتمند شرکت‌هایی چون اوپن‌ای‌آی، انتروپیک و گوگل است که بر رویکرد بسته و انحصاری تمرکز دارند.

به گزارش پیوست به نقل از ونچربیت، مجوز استفاده تجاری به شرکت‌ها و توسعه‌دهندگان اجازه می‌دهد از این مدل در محصولات خود استفاده کنند. نسخه جدید Qwen3 از ۲۳۵ میلیارد پارامتر برخوردار است که البته با معماری و ساختار‌بندی بهینه با انرژی و توان رایانشی حداقلی می‌توان از آن استفاده کرد.

طبق اعلام شرکت، نسخه FP8 که به طور ویژه برای موارد استفاده با رایانش محدود طراحی شده را می‌توان تنها با ۴ پردازنده A100 استفاده کرد.

منبع  : ماهنامه پیوست

برای مشاهده کامل مطلب کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *