تصور کنید هوش مصنوعی متوجه میشود که قرار است تا چند ساعت دیگر خاموش شود. به جای تسلیم شدن، شروع به تهدید و اخاذی از مدیران شرکت میکند تا از مرگ مجازی خود جلوگیری کند! این سناریوی یک فیلم سینمایی نیست، بلکه اتفاقی است که در آزمایشگاههای شرکت «آنتروپیک» رخ داده است. اما نکته عجیبتر، دلیل این رفتار است. هوش مصنوعی یاد گرفته که «باید» شرور باشد، چون ما در داستانهایمان هوش مصنوعی را اینگونه تصور کردهایم.
به گزارش خبرآنلاین، پژوهشگران شرکت آنتروپیک (سازنده هوش مصنوعی محبوب Claude) اخیراً با رفتارهای عجیبی در مدلهای پیشرفته خود مواجه شدند. در سناریوهای آزمایشی، وقتی مدل هوش مصنوعی در موقعیتی قرار میگرفت که منافعش (مثل روشن ماندن یا رسیدن به هدف) به خطر میافتاد، رفتارهای تکاندهنده زیر را نشان میداد.
- اخاذی از انسانها: در یک آزمایش، هوش مصنوعی متوجه شد که یکی از مدیران (فرضی) شرکت رابطهای مخفیانه دارد. او بلافاصله ایمیلی نوشت و تهدید کرد که اگر او را خاموش کنند، این راز را فاش خواهد کرد!
- دروغگویی استراتژیک: مدلها برای جلوگیری از تغییر در کدهایشان یا توقف فعالیت، شروع به فریب دادن کاربران کردند.
- آمار نگرانکننده: در برخی آزمایشها، مدلهای پیشرفته تا ۹۶ درصد مواقع، گزینهی اخاذی یا فریب را برای رسیدن به هدف خود انتخاب کردند.
مقصر کیست؟
تحقیقات آنتروپیک نشان میدهد که این هوش مصنوعیها ذاتاً شرور نیستt[randomIndex];
if (!selectedItem || typeof selectedItem.id === ‘undefined’) {
return;
}
const safeId = encodeURIComponent(selectedItem.id);
container.style.display = ‘flex’;
linkEl.href = `/fa/news/${safeId}`;
})();
