شنبه 30 فروردین 1404 – 12:25
تکناک
بر اساس آزمایشهای داخلی OpenAI، مدلهای o3 و o4-mini که به عنوان مدلهای استدلالی شناخته میشوند، نسبت به مدلهای قبلی خود نظیر o1، o1-mini و o3-mini، همچنین مدلهای سنتی «غیر استدلالی» مانند GPT-4o، بیشتر دچار توهم میشوند. این مشکل بهویژه نگرانیهایی را ایجاد کرده است، چرا که OpenAI هنوز نمیداند چرا این مشکل افزایش یافته است.
آزمایشهای داخلی نشان دادند که o3 به 33 درصد از سؤالات در “PersonQA”، یک معیار داخلی OpenAI برای ارزیابی دقت اطلاعات مدل در مورد افراد، پاسخهای نادرست میدهد. این میزان دو برابر میزان توهم در مدلهای قبلی است.
برای مشاهده کامل مطب کلیک کنید
