پنجشنبه 27 شهریور 1404 – 09:40
تکناک
همین چالش توسط Dr. Nadav Marco و Professor Andreas Stylianides برای ChatGPT-4 مطرح شد. آنان با پرسشهایی به سبک سقراط تلاش کردند که توانایی حل مسئله این چتبات را بسنجند و سپس با طرح خطاها و نسخههای جدید، او را بیشتر به آزمایش گذاشتند. پرسش کلیدی این بود که آیا چتبات تنها به دانش ذخیرهشده در پایگاه داده خود تکیه میکند یا قادر است راهحلهای نوآورانه توسعه دهد. به گفته پژوهشگران دانشگاه کمبریج، ChatGPT در مقاطعی مانند یک یادگیرنده واقعی فرضیهسازی کرد و راهحلهای خود را آزمود.
پژوهشگران در ادامه آزمایش، مسئله دو برابر کردن مساحت مستطیل و مثلث را نیز مطرح کردند. در هر دو مورد، ChatGPT بار دیگر سراغ راهحل جبری رفت و از هندسه فاصله گرفت. حتی در مسئله مستطیل به اشتباه ادعا کرد که هیچ راهحل هندسی وجود ندارد. پژوهشگران این خطا را ناشی از حدس بداهه و متاثر از بحث پیشین درباره قطر مربع دانستند. با وجود این، در مسئله مثلث سرانجام توانست پاسخ هندسی درست ارائه دهد.
برای مشاهده کامل مطب کلیک کنید
