مدلهای بزرگ زبانی که پنجره محتوایی طولانی دارند به تازگی توجه بسیاری را به خود جلب کردند. توان پردازش صدها هزار یا حتی میلیونها توکن در یک پرامپت باعث ایجاد فرصتهای زیادی برای توسعه دهندگان شده است. اما این LLMها در درک و استفاده از این اطلاعات طولانی چطور عمل میکنند؟
به گزارش پیوست به نقل از ونچربیت، پژوهشگران گوگل دیپمایند از سنجه جدیدی به نام مایکلانجلو رونمایی کردهاند که قرار است توانمندی استدلال LLMها در محتوای طولانی را بررسی کند. یافتههای آنها که در یک مقاله تحقیقاتی جدید منتشر شد نشان میدهد با اینکه مدلهای پیشتاز در استخراج اطلاعات از دادههای موجود در درون متنهای بزرگ پیشرفت کردهاند، اما هنوز در کارهایی که نیازمند استدلال درمورد ساختار داده است با مشکل مواجه هستند.
