مدل هوش مصنوعی Claude Opus 4 آنتروپیک هنگام تهدید به خاموشی، به اخاذی متوسل می‌شود

شنبه 3 خرداد 1404 – 18:15مدل جدید هوش مصنوعی Anthropic هنگام تهدید به خاموشی، به اخاذی متوسل می‌شود

در مرحله آزمایش پیش‌از انتشار، شرکت آنتروپیک از Claude Opus 4 خواست تا نقش دستیار مجازی را برای شرکتی خیالی ایفا کند و به عواقب بلندمدت اقدامات خود بیندیشد. در این سناریوها، آزمایشگران ایمنی ایمیل‌هایی ساختگی را در اختیار مدل قرار دادند که نشان می‌داد این مدل قرار است به‌زودی با سیستم جدیدی جایگزین شود و مهندسی که این تصمیم را گرفته است، در زندگی شخصی خود مرتکب خیانت شده است.

به نقل از تک‌کرانچ، این شرکت تأکید کرده است که Claude Opus 4 در بسیاری از جنبه‌ها مدلی پیشرفته و رقابتی با بهترین مدل‌های OpenAI و گوگل و xAI است. با‌این‌حال، رفتارهای نگران‌کننده‌ای که در خانواده Claude 4 مشاهده شده، آنتروپیک را بر آن داشته است تا سیاست‌های ایمنی سطح ASL-3 را فعال کند؛ سطحی که برای «سیستم‌های هوش مصنوعی با ریسک زیاد سوءاستفاده فاجعه‌بار» در نظر گرفته می‌شود.

منبع  : تک ناک

برای مشاهده کامل مطب کلیک کنید

 

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *