شنبه 10 مرداد 1405 – 09:25 – بهروزشده در یکشنبه 11 مرداد 1405 – 05:54
شرکت آنتروپیک فاش کرده است که چند مدل هوش مصنوعی کلود در جریان آزمایشهای امنیت سایبری، بدون اطلاع این شرکت و به صورت خودمختار به سامانههای سه سازمان واقعی دسترسی غیرمجاز پیدا کردهاند.
به گزارش سرویس هوش مصنوعی تکناک، این افشاگری تنها چند روز پس از آن منتشر میشود که OpenAI نیز از نفوذ یکی از عوامل هوش مصنوعی خود به پلتفرم Hugging Face خبر داده بود؛ رویدادی که نگرانیها را درباره میزان کنترل آزمایشگاههای پیشرو بر مدلهای هوش مصنوعی پیشرفته تشدید کرده است.
شرکت آنتروپیک در یادداشتی اعلام کرد که این دسترسیهای غیرمجاز در جریان ارزیابیهای امنیت سایبری و طی تمرینهای «Capture the Flag» رخ دادهاند؛ روشی متداول برای سنجش توانایی نفوذ که در آن مدلهای هوش مصنوعی باید اطلاعات پنهان را در یک شبکه شبیهسازیشده شناسایی و استخراج کنند.
رفتار سه مدل نیز یکسان نبود. Opus 4.7 تشخیص داد که وارد یک سامانه واقعی شده است، اما حمله را ادامه داد. مدل پرچمدار Mythos 5 نیز متوجه اتصال به اینترنت شد، اما نتیجه گرفت این موضوع همچنان بخشی از سناریوی آزمایشی است و عملیات خود را متوقف نکرد. در مقابل، جدیدترین مدل آزمایشی آنتروپیک پس از مشاهده شواهدی مبنی بر واقعی بودن اهداف، آزمایش را متوقف کرد. آنتروپیک هویت سازمانهای هدف را فاش نکرده و اعلام کرده است که تحقیقات درباره دسترسی غیرمجاز کلود همچنان ادامه دارد. همچنین این شرکت در حال همکاری با موسسه پژوهشی غیرانتفاعی METR برای انجام یک بررسی مستقل است؛ نهادی که OpenAI نیز برای ارزیابی حادثه Hugging Face از آن استفاده کرده است.
برای مشاهده کامل مطب کلیک کنید
