محققان اپل روشهای تازهای را برای آموزش مدلهای بزرگ متنی و تصویری توسعه دادهاند که در عمل آنها را قدرتمندتر و انعطافپذیرتر میکند. ونچربیت میگوید این پیشرفت از اهمیت چشمگیری برای محصولات هوش مصنوعی و آینده اپل برخوردار است.
به گزارش پیوست، تحقیقاتی که در مقالهای با نام «MM1: روشها، تجزیهتحلیل و چشماندازهایی از پیش آموزش LLM چندوجهی» در وبسایت arxiv.org منتشر شده نشان میدهد که چطور ترکیب انواع مختلف از دادههای آموزشی و ساختارهای مدل میتواند فوقالعاده در چندین حوزه مهم هوش مصنوعی منتهی شود.
محققان میگویند: «ما مشخص کردیم که استفاده از یک ترکیب دقیق دادههای متشکل از تصویر-توضیحات، تصویر-متن مرتبط و متن خالی برای رسیدن به نتایج سریع و عالی در چنین حوزه ضرورت دارد.» مدلهای MM1 با آموزش از طریق دیتاستهای متنوع دیداری و زبانی، میتوانند در کارهایی مثل توضیح تصویر، پاسخ به سوالات دیداری و زبان طبیعی پیشرفت کنند.
