پنجشنبه 18 بهمن 1403 – 21:35
تککرانچ مینویسد که تیم توسعهدهنده s1 ابتدا از مدل پایه آماده استفاده و سپس آن را ازطریق فرایند تقطیر بهینهسازی کرد. در این روش، قابلیتهای استدلالی مدل هوش مصنوعی دیگر با آموزش براساس پاسخهای آن استخراج میشود. به گفته پژوهشگران، مدل s1 از یکی از مدلهای استدلالی شرکت گوگل با نام Gemini 2.0 Flash Thinking Experimental تقطیر شده است. پیشتر نیز پژوهشگران دانشگاه برکلی این روش را برای ساخت مدلی استدلالی با هزینهای حدود ۴۵۰ دلار به کار گرفته بودند.
اگر بتوان با هزینهای ناچیز مدلی همسطح نمونهای چندمیلیوندلاری توسعه داد؛ پس مزیت رقابتی شرکتهای بزرگ چیست؟ جای تعجب ندارد که شرکتهای بزرگ هوش مصنوعی از این روند ناخشنود باشند. شرکت OpenAI پیشتر دیپسیک را به استفاده غیرمجاز از دادههای API خود برای تقطیر مدلهای هوش مصنوعی متهم کرده بود.
برای مشاهده کامل مطب کلیک کنید
