پنجشنبه 23 اسفند 1403 – 12:00
تکناکGoogle AI StudioGemini APIویرایش تصویر در مکالمات
مدل Gemini 2.0 Flash که در دسامبر گذشته معرفی شد، علاوه بر متن، توانایی تولید صدا و تصویر را نیز دارد. این ویژگی بخشی از تلاش گوگل برای توسعه یک مدل چندوجهی (Multimodal) میباشد، که قادر به پردازش انواع ورودیها و تولید خروجیهای متنوع است. کاربران در این نسخه علاوه بر دریافت تصاویر، میتوانند آنها را در مکالمهای طبیعی و در چندین مرحله ویرایش کنند، در حالی که زمینه گفتوگو حفظ میشود.
شرکت گوگل اعلام کرده است که Gemini 2.0 Flash با استفاده از دانش جهانی و استدلال پیشرفته، تصاویر دقیقتر و واقعگرایانهتری تولید میکند، که میتواند برای مصورسازی دستور پخت غذا، روایتهای تصویری و ایجاد محتوای بصری تعاملی مورد استفاده قرار گیرد.
برای مشاهده کامل مطب کلیک کنید
