استارتآپ چینی دیپسیک اعلام کرده است که مدل جدید ریاضی این شرکت به نام DeepseekMath-V2 موفق شده تا در آزمونهای سطح بالای ریاضی از جمله المپیاد بینالمللی ریاضی (IMO 2025) و المپیاد ریاضی چین (CMO 2024) به سطح مدال طلا دست پیدا کند. این مدل همچنین در آزمون مشهور پاتنام امتیاز خارقالعاده ۱۱۸ از ۱۲۰ را کسب کرده و این در حالی است که بهترین عملکرد انسانی ۹۰ امتیاز گزارش شده است.
به گزارش پیوست به نقل از دیکودر، دیپسیک در مقاله منتشر شده به هیچگونه ابزار ماشین حساب یا استفاده از کد خارجی اشاره نکرده که نشان میدهد این فرایند تنها از طریق زبان طبیعی صورت گرفته است. شرکت توضیح داده که مدلهای هوش مصنوعی گذشته، معمولا بدون اینکه کار و فرایند حل مساله را به درستی انجام دهند، به پاسخ درست میرسیدند.
برای رفع این مشکل، DeepseekMath-V2 از یک فرآیند چندمرحلهای استفاده میکند که شامل دو بخش است. در بخش اول یک راست آزمایی توسط Verifier صورت میگیرد و اثبات اولیه مورد ارزیابی قرار میگیرد. در مرحله دوم اما Meta-verifier نقدهای مرحله قبلی یعنی Verifier را مورد ارزیابی قرار میدهد تا ایرادهای واقعی مشخص شوند.
