گوگل در ادامهی توسعه مدلهای چندوجهی خود، از مدل جدید Gemini 2.5 Computer Use رونمایی کرده است که به طور ویژه برای کنترل و تعامل مستقیم با رابطهای کاربری طراحی شده است. این مدل که بر پایهی قابلیتهای درک تصویری و استدلالی نسخه Gemini 2.5 Pro ساخته شده، میتوانند همانند انسانها با صفحات وب و اپلیکیشنهای موبایل کار کند و از کلیککردن و تایپ گرفته تا پرکردن فرمها و مدیریت فیلدهای تعاملی را برعهده گیرد.
به گزارش پیوست، گوگل در پست وبلاگی خود میگوید این مدل جدید اکنون از طریق Gemini API در Google AI Studio و Vertex AI در دسترس توسعهدهندگان قرار گرفته و به گفتهی گوگل، در بنچمارکهای کنترل وب و موبایل عملکردی فراتر از رقبای اصلی خود دارد و تاخیر یا لتنسی را نیز کاهش داده است.
