شنبه 10 مرداد 1405 – 11:30 – بهروزشده در یکشنبه 11 مرداد 1405 – 05:47
شرکت گوگل دیپمایند با معرفی مدل هوش مصنوعی Gemini Robotics ER 2، توانایی رباتهای انساننما را در درک محیط، برنامهریزی، تصمیمگیری و همکاری همزمان افزایش داد.
به گزارش سرویس هوش مصنوعی تکناک، این شرکت سال گذشته خانواده Gemini Robotics را با هدف انتقال قابلیتهای استدلال چندوجهی به دنیای واقعی معرفی کرد. در این خانواده، مدل Vision-Language-Action (VLA) وظیفه کنترل مستقیم حرکات ربات را بر عهده دارد. در مقابل، Gemini Robotics ER نقش مغز متفکر را ایفا میکند. این مدل محیط اطراف را تحلیل میکند، برای انجام وظایف برنامه میریزد و اقدام بعدی ربات را تعیین میکند.
گوگل از زمان معرفی نخستین نسخه این فناوری در مارس ۲۰۲۵، چندین بهروزرسانی برای آن منتشر کرده است. نسخه ER 1.5 در سپتامبر سال گذشته عملکردی در سطح پیشرفتهترین مدلها ثبت کرد. نسخه ER 1.6 نیز در آوریل امسال با افزایش دقت درک محیط عرضه شد. اکنون نسخه ER 2 قابلیتهای بیشتری را در اختیار رباتها قرار میدهد.
یکی دیگر از قابلیتهای جدید، درک پیوسته ویدیو است. این مدل روند اجرای هر وظیفه را به صورت لحظهای بررسی میکند. سپس میزان پیشرفت را میسنجد. اگر خطایی رخ دهد، همان مرحله را دوباره اجرا میکند. این روش از تکرار کل فرایند جلوگیری میکند و سرعت انجام مأموریت را افزایش میدهد.
برای مشاهده کامل مطب کلیک کنید
