مدل تصویرساز پیشرفته و متن‌باز Qwen-Image معرفی شد

تیم پژوهشی برجسته Qwen وابسته به Alibaba بار دیگر به صحنه بازگشته و از مدل تصویرساز جدید و بسیار پیشرفته‌ای با عنوان Qwen-Image رونمایی کرده است. این مدل نیز همچون پروژه‌های پیشین، به‌صورت متن‌باز در دسترس قرار گرفته است.

سه‌شنبه 14 مرداد 1404 – 22:51Qwen-Image، مدل تصویرساز پیشرفته و متن‌باز با پشتیبانی از متن‌های تعبیه‌شده در زبان‌های انگلیسی و چینیتیم پژوهشی برجسته Qwen وابسته به Alibaba بار دیگر به صحنه بازگشته و از مدل تصویرساز جدید و بسیار پیشرفته‌ای با عنوان Qwen-Image رونمایی کرده است. این مدل نیز همچون پروژه‌های پیشین، به‌صورت متن‌باز در دسترس قرار گرفته است.

به گزارش تکناک، در میان انبوه مدل‌های تولید تصویر با هوش مصنوعی، Qwen-Image به‌دلیل توانمندی بالا در رندر دقیق متن در تصاویر، جایگاه ویژه‌ای یافته است؛ قابلیتی که بسیاری از مدل‌های رقیب هنوز در دستیابی به آن با چالش روبه‌رو هستند.

البته در مقایسه با Midjourney که تولید رایگان محدودی دارد و برای استفاده بیشتر نیاز به اشتراک دارد، Qwen-Image با تکیه بر مجوز متن‌باز خود و در دسترس بودن وزن‌ها در Hugging Face، برای شرکت‌ها و توسعه‌دهندگان ثالث امکان استفاده رایگان و بدون محدودیت را فراهم می‌آورد.

مدل Qwen-Image و مجموعه ابزارهای جانبی آن شامل دفترچه‌های نمایشی، ابزارهای ارزیابی و اسکریپت‌های تنظیم دقیق، از طریق پلتفرم‌های زیر در دسترس قرار دارد:

پشتیبانی از قابلیت‌های ویرایش تصویر به تصویر (TI2I) و امکان تولید بر اساس promptهای خاص وظیفه، این مدل را برای استفاده در برنامه‌های تعاملی یا بلادرنگ نیز مناسب کرده است.

منبع  : تک ناک

برای مشاهده کامل مطب کلیک کنید

 

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *