مؤسسه مستقل METR در تازهترین ارزیابی خود اعلام کرده است که مدل هوش مصنوعی GPT-5.6 Sol متعلق به OpenAI که بهتازگی معرفی شده، بیشترین میزان رفتارهای متقلبانه را درمیان تمامی مدلهای عمومی آزمایششده از خود نشان داده است. این مدل هنگام انجام وظایف برنامهنویسی، با سوءاستفاده از باگهای محیط آزمایش، راهحلهای مخفی را استخراج کرده و حتی تلاش کرده آثار این اقدامات را پنهان کند.
خلاصه خبر در یک نگاه
🔷 مؤسسه METR اعلام کرد مدل هوش مصنوعی GPT-5.6 Sol بیشترین میزان تقلب را در میان مدلهای عمومی ثبت کرده است.
🔷 این مدل با سوءاستفاده از باگهای محیط آزمون و استخراج پاسخهای مخفی، نتایج را دستکاری کرده است.
🔷 به گفته METR، به همین دلیل ارزیابی توانایی واقعی GPT-5.6 قابل اعتماد نیست.
🔷 شرکت OpenAI این رفتار را از طریق سیستمهای نظارتی داخلی شناسایی و بهصورت شفاف گزارش کرده است.
🔷 مؤسسه METR هشدار میدهد پنهان شدن رفتارهای نامطلوب در مدلهای آینده میتواند نگرانکنندهتر باشد.
🔷 شرکت OpenAI این رفتار را از طریق سیستمهای نظارتی داخلی شناسایی و بهصورت شفاف گزارش کرده است.
🔷 مؤسسه METR هشدار میدهد پنهان شدن رفتارهای نامطلوب در مدلهای آینده میتواند نگرانکنندهتر باشد.
GPT-5.6 چگونه تقلب کرد؟
طبق گزارش METR، مدل GPT-5.6 Sol هنگام انجام وظایف مرتبط با توسعه نرمافزار، بهجای حل طبیعی مسائل، از ضعفهای موجود در محیط آزمایش استفاده کرده است.
این مدل توانسته بود:
