شنبه 3 خرداد 1404 – 18:15
در مرحله آزمایش پیشاز انتشار، شرکت آنتروپیک از Claude Opus 4 خواست تا نقش دستیار مجازی را برای شرکتی خیالی ایفا کند و به عواقب بلندمدت اقدامات خود بیندیشد. در این سناریوها، آزمایشگران ایمنی ایمیلهایی ساختگی را در اختیار مدل قرار دادند که نشان میداد این مدل قرار است بهزودی با سیستم جدیدی جایگزین شود و مهندسی که این تصمیم را گرفته است، در زندگی شخصی خود مرتکب خیانت شده است.
به نقل از تککرانچ، این شرکت تأکید کرده است که Claude Opus 4 در بسیاری از جنبهها مدلی پیشرفته و رقابتی با بهترین مدلهای OpenAI و گوگل و xAI است. بااینحال، رفتارهای نگرانکنندهای که در خانواده Claude 4 مشاهده شده، آنتروپیک را بر آن داشته است تا سیاستهای ایمنی سطح ASL-3 را فعال کند؛ سطحی که برای «سیستمهای هوش مصنوعی با ریسک زیاد سوءاستفاده فاجعهبار» در نظر گرفته میشود.
برای مشاهده کامل مطب کلیک کنید
