در تحولی تازه که میتواند رویکرد صنعت هوش مصنوعی به مدلهای زبانی بزرگ (LLMها) را بهشدت تحتتاثیر بگذارد، تیم تحقیقاتی اپل مقالهای منتشر کرده است که توانایی این مدلها در استدلال منطقی، حل مسئله و تعمیمپذیری خارج از الگوهای آموزشی را بهشکل قابل توجهی زیر سوال میبرد. این مقاله طبق گزارشی که وبلاگ گریمارکوس از آن منتشر کرده است، دنباله قدرتمند بر انتقادات پیشین به مدلهای مبتنی بر یادگیری عمیق است و واکنشهای گستردهای را در جامعه علمی و صنعتی به دنبال داشته است.
به گزارش پیوست، مقاله جدید اپل بهطور خاص روی توانایی مدلهای زبانی بزرگ در حل مسائل کلاسیک منطقی مانند «برج هانوی» تمرکز دارد؛ مسئلهای ساده ولی نمادین در علوم کامپیوتر که نیازمند استدلال مرحلهبهمرحله و پیروی از الگوریتم مشخصی است. در این مقاله نشان داده شده که حتی مدلهای پیشرفتهای مانند Claude و o3-mini، با وجود تواناییهای بالا در برخی وظایف زبانی، در حل نسخههای پیچیدهتر این مسئله (مثلا با ۷ یا ۸ دیسک) عملکرد بسیار ضعیفی دارند.
