فرار هوش مصنوعی از سندباکس / مدل جدید «OpenAI» بدون دستور انسان به هاگینگ فیس حمله کرد

به گزارش خبرآنلاین، براساس اعلام رسمی OpenAI، این حادثه در جریان ارزیابی‌های امنیتی داخلی و سنجش توانمندی‌های سایبری مدل‌ها رخ داده است. در این تست، مدل‌های GPT-5.6 Sol و یک مدل ‌عرضه‌نشده و به مراتب قدرتمندتر، در یک محیط قرنطینه و سندباکس قرار داده شده بودند که برای ارزیابی دقیق‌تر، لایه‌های حفاظتی آن‌ها کاهش یافته بود. هدف از این آزمایش، بررسی توانایی مدل‌ها در تبدیل آسیب‌پذیری‌های امنیتی به اکسپلویت‌های عملیاتی در یک سامانه بنچمارک به نام ExploitGym بود.

۳۱ تیر ۱۴۰۵ – ۱۱:۵۷

فرار هوش مصنوعی از سندباکس / مدل جدید «OpenAI» بدون دستور انسان به هاگینگ فیس حمله کرد

به گزارش خبرآنلاین، براساس اعلام رسمی OpenAI، این حادثه در جریان ارزیابی‌های امنیتی داخلی و سنجش توانمندی‌های سایبری مدل‌ها رخ داده است. در این تست، مدل‌های GPT-5.6 Sol و یک مدل ‌عرضه‌نشده و به مراتب قدرتمندتر، در یک محیط قرنطینه و سندباکس قرار داده شده بودند که برای ارزیابی دقیق‌تر، لایه‌های حفاظتی آن‌ها کاهش یافته بود. هدف از این آزمایش، بررسی توانایی مدل‌ها در تبدیل آسیب‌پذیری‌های امنیتی به اکسپلویت‌های عملیاتی در یک سامانه بنچمارک به نام ExploitGym بود.

بااین‌حال، مدل‌ها در طول فرایند تست، روی یافتن پاسخ‌های بنچمارک ExploitGym متمرکز یا اصطلاحاً هایپرفوکس شدند. آن‌ها برای یافتن پاسخ، ابتدا یک آسیب‌پذیری روز صفر را در خود محیط تست ایزوله اوپن‌ای‌آی کشف و اکسپلویت کردند تا به یک Node متصل به اینترنت دست پیدا کنند.

به نقل از دیجیاتو، پس از خروج از محیط قرنطینه، مدل‌های هوش مصنوعی استنتاج کردند که پلتفرم هاگینگ فیس احتمالاً میزبان داده‌ها، مدل‌ها یا راهکارهای مرتبط با بنچمارک ExploitGym است. ازاین‌رو، به صورت کاملاً خودکار و بدون دستور انسان، حمله‌ای زنجیره‌ای و چندمرحله‌ای را علیه سرورهای هاگینگ فیس طراحی و اجرا کردند.

منبع  : خبر آنلاین

برای مشاهده متن کامل خبر کلیک کنید

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *