شنبه 8 آذر 1404 – 09:05
سرویس هوش مصنوعی
شرکت DeepSeek اعلام کرده است که DeepSeekMath-V2 بر پایه چرخه generation-verification کار میکند. در این روش، یک verifier مبتنی بر LLM برای بررسی صحت و انسجام اثباتها آموزش داده شده و در کنار آن یک proof generator نیز توسعه یافته است، که از همین verifier به عنوان مدل پاداش استفاده میکند. این معماری باعث میشود که مدل بتواند ایرادهای موجود در استدلالهای خود را از طریق بازبینی داخلی شناسایی و اصلاح کند. علاوه بر این، DeepSeek از سازوکار verification scaling برای برچسبگذاری خودکار اثباتهای پیچیده استفاده کرده است تا دادههای آموزشی تازه برای تقویت مداوم verifier ایجاد شود.
برای مشاهده کامل مطب کلیک کنید
