محققان متا مدل تازهای را منتشر کردند که روند آموزشی متفاوت از مدلهای بزرگ زبانی دارد. این مدل با تماشای ویدیو و خیلی شبیهتر به انسان و موجودات زنده یاد میگیرد. مدیر هوش مصنوعی متا پیشتر به محدودیتهای هوش مصنوعی امروز در مقایسه با انسان و دیگر موجودات زنده اشاره کرده بود و این نوآوری شاید گام بزرگی به سوی آینده باشد.
به گزارش پیوست، در چند روزی که گذشت سه غول هوش مصنوعی از نوآوریهای خود رونمایی کردند. اوپنایآی از مولد ویدیویی به نام سورا پرده برداشت و گوگل هم جمینی ۱.۵ را عرضه کرد. شرکت متا هم که رویکردی متنباز را برخلاف دو شرکت دیگر در پیش گرفته حالا از مدلی به نام V-JEPA رونمایی کرده و می گوید روش یادگیری آن شبیهتر به موجودات زنده است.
به گفته متا این مدل گامی در جهت ساخت سیستمهایی است که میتوانند جهان فیزیکی را درک کنند زیرا قابلیت یادگیری از ویدیو را دارد. مدلهای زبانی بزرگ معمولا براساس تعداد زیادی جمله و عبارت آموزش داده میشوند و در روند آموزش مدل یاد میگیرد که چطور جاهای خالی و پنهان شده یک جمله را پر کند. به این ترتیب میتواند رفتهرفته یک سری از کلمات را در محتملترین حالتش کنار هم بچیند و جملاتی معنادار تشکیل دهد.
