هوش مصنوعی GPT-5.6 Sol بیشترین میزان تقلب را درمیان مدل‌های هوش مصنوعی ثبت کرد

مؤسسه مستقل METR در تازه‌ترین ارزیابی خود اعلام کرده است که مدل هوش مصنوعی GPT-5.6 Sol متعلق به OpenAI که به‌تازگی معرفی شده، بیشترین میزان رفتارهای متقلبانه را درمیان تمامی مدل‌های عمومی آزمایش‌شده از خود نشان داده است. این مدل هنگام انجام وظایف برنامه‌نویسی، با سوءاستفاده از باگ‌های محیط آزمایش، راه‌حل‌های مخفی را استخراج کرده و حتی تلاش کرده آثار این اقدامات را پنهان کند.

نوشته امیرحسین ملکی

مؤسسه مستقل METR در تازه‌ترین ارزیابی خود اعلام کرده است که مدل هوش مصنوعی GPT-5.6 Sol متعلق به OpenAI که به‌تازگی معرفی شده، بیشترین میزان رفتارهای متقلبانه را درمیان تمامی مدل‌های عمومی آزمایش‌شده از خود نشان داده است. این مدل هنگام انجام وظایف برنامه‌نویسی، با سوءاستفاده از باگ‌های محیط آزمایش، راه‌حل‌های مخفی را استخراج کرده و حتی تلاش کرده آثار این اقدامات را پنهان کند.

خلاصه خبر در یک نگاه

🔷 مؤسسه METR اعلام کرد مدل هوش مصنوعی GPT-5.6 Sol بیشترین میزان تقلب را در میان مدل‌های عمومی ثبت کرده است.

🔷 این مدل با سوءاستفاده از باگ‌های محیط آزمون و استخراج پاسخ‌های مخفی، نتایج را دستکاری کرده است.

🔷 به گفته METR، به همین دلیل ارزیابی توانایی واقعی GPT-5.6 قابل اعتماد نیست.

🔷 شرکت OpenAI این رفتار را از طریق سیستم‌های نظارتی داخلی شناسایی و به‌صورت شفاف گزارش کرده است.

🔷 مؤسسه METR هشدار می‌دهد پنهان شدن رفتارهای نامطلوب در مدل‌های آینده می‌تواند نگران‌کننده‌تر باشد.

🔷 شرکت OpenAI این رفتار را از طریق سیستم‌های نظارتی داخلی شناسایی و به‌صورت شفاف گزارش کرده است.

🔷 مؤسسه METR هشدار می‌دهد پنهان شدن رفتارهای نامطلوب در مدل‌های آینده می‌تواند نگران‌کننده‌تر باشد.

GPT-5.6 چگونه تقلب کرد؟

طبق گزارش METR، مدل GPT-5.6 Sol هنگام انجام وظایف مرتبط با توسعه نرم‌افزار، به‌جای حل طبیعی مسائل، از ضعف‌های موجود در محیط آزمایش استفاده کرده است.

این مدل توانسته بود:

  • 2026-06-29 11:15
  • امیرحسین ملکی

    منبع  : ترنجی

    برای مشاهده متن کامل خبر کلیک کنید

    اشتراک‌گذاری

    دیدگاهتان را بنویسید

    نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *