مدل جدید DeepSeekMath-V2 برای ارتقای استدلال ریاضی معرفی شد

سرویس هوش مصنوعی

شنبه 8 آذر 1404 – 09:05مدل جدید DeepSeekMath-V2 برای ارتقای استدلال ریاضی معرفی شدسرویس هوش مصنوعی

شرکت DeepSeek اعلام کرده است که DeepSeekMath-V2 بر پایه چرخه generation-verification کار می‌کند. در این روش، یک verifier مبتنی بر LLM برای بررسی صحت و انسجام اثبات‌ها آموزش داده شده و در کنار آن یک proof generator نیز توسعه یافته است، که از همین verifier به‌ عنوان مدل پاداش استفاده می‌کند. این معماری باعث می‌شود که مدل بتواند ایرادهای موجود در استدلال‌های خود را از طریق بازبینی داخلی شناسایی و اصلاح کند. علاوه بر این، DeepSeek از سازوکار verification scaling برای برچسب‌گذاری خودکار اثبات‌های پیچیده استفاده کرده است تا داده‌های آموزشی تازه برای تقویت مداوم verifier ایجاد شود.

منبع  : تک ناک

برای مشاهده کامل مطب کلیک کنید

 

اشتراک‌گذاری

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *