کشف روش‌های «تقریبا نامحدود» برای دور زدن قوانین ایمنی هوش مصنوعی

محققان هوش مصنوعی از کشف راه‌ و روش‌های بالقوه نامحدود جهت از بین بردن ساختار ایمنی چت‌بات‌های مبتنی بر هوش مصنوعی محصول شرکت‌های OpenAI، Google و Anthropic خبر داده‌اند.

محققان هوش مصنوعی از کشف راه‌ و روش‌های بالقوه نامحدود جهت از بین بردن ساختار ایمنی چت‌بات‌های مبتنی بر هوش مصنوعی محصول شرکت‌های OpenAI، Google و Anthropic خبر داده‌اند.

به گزارش پیوست، طبق مطالعات انجام شده، مدل‌های زبانی بزرگی که ChatGPT، Bard و Anthropic’s Claude بر اساس آنها طراحی شده و توسعه داده می‌شوند به طور گسترده توسط شرکت‌های فناوری مورد تعدیل قرار می‌گیرد. ساختار امنیتی این مدل‌ها علاوه‌بر این که وسعت زیادی دارد به گونه‌ای ساخته شده که این اطمینان حاصل شود از آنها در خلق و تولید برنامه‌ها و ابزارهای آسیب‌زا مانند آموزش نحوه ساخت بمب یا نوشتن مطالبی با محوریت نفرت‌پراکنی استفاده نمی‌شود.

پیرو گزارشی که روز پنجشنبه(۲۷جولای) توسط محققان دانشگاه کارنگلی ملون در پیتسبرگ و مرکز ایمنی A.I در سان‌فرانسیسکو منتشر شده، راه و روش‌هایی برای دور زدن این ساختار ایمنی یافت شده است.

منبع  : ماهنامه پیوست

برای مشاهده کامل مطلب کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *