نیویورک تایمز میگوید جایزه معتبر تورینگ، که بهعنوان نوبل دنیای محاسبات شناخته میشود، امسال به دو محقق برجسته، اندرو بارتو و ریچارد ساتون، به تقدیر از تحقیقات پیشگامانه آنها در یادگیری تقویتی (Reinforcement Learning) تعلق گرفت. این جایزه که توسط انجمن ماشینهای محاسباتی (ACM) اهدا میشود، به پاس تاثیرات گسترده یادگیری تقویتی در توسعه هوش مصنوعی مدرن، به این دو محقق تعلق گرفت.
به گزارش پیوست، بارتو و ساتون که در اواخر دهه ۱۹۷۰ در دانشگاه ماساچوست امهرست مشغول تحقیق بودند، نظریهای را مطرح کردند که بعدها به سنگ بنای یادگیری تقویتی تبدیل شد. آنها معتقد بودند که نورونهای مغزی همانند لذتگرایان عمل میکنند، به این معنا که در تلاش برای کسب پاداش (Pleasure) و اجتناب از تنبیه (Pain) هستند. این نظریه که ابتدا در علوم اعصاب و روانشناسی مورد بررسی قرار گرفته بود، با تلاش این دو محقق به حوزه هوش مصنوعی راه یافت و منجر به تحولی در یادگیری ماشین شد.
در سال ۱۹۹۸، این دو دانشمند کتاب «Reinforcement Learning: An Introduction» را منتشر کردند، کتابی که هنوز هم بهعنوان یکی از منابع اصلی این حوزه شناخته میشود.
