درک و استدلال مدل‌های بزرگ زبانی با افزایش طول محتوا کاهش می‌یابد

مدل‌های بزرگ زبانی که پنجره محتوایی طولانی دارند به تازگی توجه بسیاری را به خود جلب کردند. توان پردازش صد‌ها هزار یا حتی میلیون‌ها توکن در یک پرامپت باعث ایجاد فرصت‌های زیادی برای توسعه دهندگان شده است. اما این LLMها در درک و استفاده از این اطلاعات طولانی چطور عمل می‌کنند؟

مدل‌های بزرگ زبانی که پنجره محتوایی طولانی دارند به تازگی توجه بسیاری را به خود جلب کردند. توان پردازش صد‌ها هزار یا حتی میلیون‌ها توکن در یک پرامپت باعث ایجاد فرصت‌های زیادی برای توسعه دهندگان شده است. اما این LLMها در درک و استفاده از این اطلاعات طولانی چطور عمل می‌کنند؟

به گزارش پیوست به نقل از ونچربیت، پژوهشگران گوگل دیپ‌مایند از سنجه جدیدی به نام مایکل‌انجلو رونمایی کرده‌اند که قرار است توانمندی استدلال LLMها در محتوای طولانی را بررسی کند. یافته‌های آنها که در یک مقاله تحقیقاتی جدید منتشر شد نشان می‌دهد با اینکه مدل‌های پیشتاز در استخراج اطلاعات از داده‌های موجود در درون متن‌های بزرگ پیشرفت کرده‌اند، اما هنوز در کارهایی که نیازمند استدلال درمورد ساختار داده است با مشکل مواجه هستند.

منبع  : ماهنامه پیوست

برای مشاهده کامل مطلب کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *