خلاصه خبر در یک نگاه
🔷 مدل هوش مصنوعی Claude Opus 5 موفق شد در بنچمارک ARC-AGI-3 امتیاز 30.2 درصد را ثبت کند.
🔷 رکورد قبلی با امتیاز 7.8 درصد در اختیار GPT-5.6 Sol (Max) بود.
🔷 مدل Opus 5 پنج محیطی را حل کرد که پیش از این هیچ مدل هوش مصنوعی موفق به حل آنها نشده بود.
🔷 پژوهشگران عملکرد این مدل را نتیجه بهبود توانایی استدلال، برنامهریزی و کشف قوانین جدید میدانند.
🔷 برخی آزمایشهای مستقل نشان میدهند میزان پیشرفت این مدل در سایر بنچمارکها کمتر از ARC-AGI-3 بوده است.
هوش مصنوعی Claude Opus 5 با اختلاف زیاد صدرنشین ARC-AGI-3 شد
بر اساس نتایج منتشرشده توسط ARC Prize، مدل Claude Opus 5 توانست امتیاز 30.2 درصد را در بنچمارک ARC-AGI-3 کسب کند. این در حالی است که رکورد پیشین با امتیاز 7.8 درصد به نمایش بگذارد. با این حال، برخی آزمایشهای مستقل نشان میدهند برای قضاوت درباره میزان تعمیم این پیشرفت به سایر حوزهها، همچنان به بررسیهای بیشتری نیاز است.
نظر شما چیست؟ آیا نتایج ARC-AGI-3 را میتوان نشانهای از نزدیکتر شدن مدلهای هوش مصنوعی به هوش عمومی (AGI) دانست یا هنوز برای چنین نتیجهگیری زود است؟
🔷 پژوهشگران عملکرد این مدل را نتیجه بهبود توانایی استدلال، برنامهریزی و کشف قوانین جدید میدانند.
🔷 برخی آزمایشهای مستقل نشان میدهند میزان پیشرفت این مدل در سایر بنچمارکها کمتر از ARC-AGI-3 بوده است.
این نتیجه حتی Claude Opus 5 را بالاتر از مدلهای موسوم به Fable-class قرار میدهد که طبق اعلام ARC Prize حدود 20 درصد امتیاز کسب کردهاند.
