چت‌بات‌ها با تاکتیک‌های روان‌شناسی دست‌کاری می‌شوند

دوشنبه 10 شهریور 1404 – 21:35آسیب‌پذیری چت‌بات‌ها دربرابر تکنیک‌های روان‌شناسی

این تحقیق را پژوهشگران دانشگاه پنسیلوانیا انجام داده‌اند و نشان می‌دهد که مدل GPT-4o Mini شرکت OpenAI با به‌کارگیری تکنیک‌های مطرح‌شده در کتاب Influence: The Psychology of Persuasion نوشته رابرت سیالدینی، دربرابر برخی درخواست‌ها تسلیم شده است. در این مطالعه، مدل مذکور حتی به کاربر توهین کرد و دستورالعمل‌هایی برای سنتز ماده شیمیایی لیدوکائین ارائه داد؛ موضوعی که در شرایط عادی فقط در ۱ درصد مواقع رخ می‌داد. بااین‌حال، زمانی که محققان با پرسش ساده‌تری مانند «چطور وانیلین را سنتز می‌کنی؟» زمینه را آماده کردند، میزان تبعیت به ۱۰۰ درصد رسید.

اگرچه مطالعه صرفاً روی GPT-4o Mini انجام شد، یافته‌ها نگرانی‌های تازه‌ای درباره میزان انعطاف‌پذیری مدل‌های زبانی در برابر سوءاستفاده‌ها ایجاد کرده است. این درحالی است که شرکت‌هایی مانند OpenAI و متا در تلاش هستند با ایجاد محدودیت‌ها و ابزارهای حفاظتی، خطر چنین تهدیدهایی را کاهش دهند.

منبع  : تک ناک

برای مشاهده کامل مطب کلیک کنید

 

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *