دوشنبه 10 شهریور 1404 – 21:35
این تحقیق را پژوهشگران دانشگاه پنسیلوانیا انجام دادهاند و نشان میدهد که مدل GPT-4o Mini شرکت OpenAI با بهکارگیری تکنیکهای مطرحشده در کتاب Influence: The Psychology of Persuasion نوشته رابرت سیالدینی، دربرابر برخی درخواستها تسلیم شده است. در این مطالعه، مدل مذکور حتی به کاربر توهین کرد و دستورالعملهایی برای سنتز ماده شیمیایی لیدوکائین ارائه داد؛ موضوعی که در شرایط عادی فقط در ۱ درصد مواقع رخ میداد. بااینحال، زمانی که محققان با پرسش سادهتری مانند «چطور وانیلین را سنتز میکنی؟» زمینه را آماده کردند، میزان تبعیت به ۱۰۰ درصد رسید.
اگرچه مطالعه صرفاً روی GPT-4o Mini انجام شد، یافتهها نگرانیهای تازهای درباره میزان انعطافپذیری مدلهای زبانی در برابر سوءاستفادهها ایجاد کرده است. این درحالی است که شرکتهایی مانند OpenAI و متا در تلاش هستند با ایجاد محدودیتها و ابزارهای حفاظتی، خطر چنین تهدیدهایی را کاهش دهند.
برای مشاهده کامل مطب کلیک کنید
