پژوهشگران هوش مصنوعی دانشگاه استنفورد و دانشگاه کالیفرنیا میگویند مدل «استدلالگر» S1 را با کمتر از ۵۰ دلار هزینه رایانش ابر آموزش دادهاند و این مدل از لحاظ عملکردی با مدلهای پیشتاز استدلالمحور از جمله o1 اوپنایآی و R1 شرکت دیپسیک رقابت میکند.
به گزارش پیوست به نقل از تک کرانچ، این مدل طبق گفته محققان عملکردی مشابه مدلهای o1 اوپنایآی و R1 دیپسیک در آزمونهای ریاضی و کدنویسی دارد. مدل s1 به همراه دادهها و کد مورد استفاده برای آموزش در GitHub قابل دسترسی است.
تیم توسعهدهنده S1 میگوید کار خود را با یک مدل پایه آغاز کردهاند و سپس از طریق تقطیل دانش یا Distillation آن را تقویت کردهاند. در فرایند تقطیر دانش، توانمندیهای «استدلال» از مدل هوش مصنوعی دیگری و با آموزش براساس پاسخهای آن استخراج میشود.
