سهشنبه 14 اسفند 1403 – 13:20
تکناک
هوش مصنوعی GPT-4.5 در روزهای اخیر توانست در Chatbot Arena وارد رقابت شود و در اکثر دستهها، رتبه شماره یک را از آن خود کند. این مدل در زمینههای مختلف از جمله چند مرحلهای (Multi-Turn)، درخواستهای سخت (Hard Prompts)، برنامهنویسی (Coding)، ریاضیات (Math)، نوشتار خلاقانه (Creative Writing)، پیروی از دستورالعملها (Instruction Following) و پرسشهای طولانیتر (Longer Query) پیشتاز بود. همچنین GPT-4.5 توانست در رتبهبندی کنترل سبک (Style Control) نیز به عنوان پیشرو ظاهر شود.
همچنین مدل GPT-4.5 در چندین معیار مهم دیگر هوش مصنوعی نیز موفق عمل کرد. در معیار بازی حذف (Elimination Game)، که مدلهای زبان بزرگ (LLM) را در زمینههای استدلال اجتماعی، استراتژی و فریب مورد آزمایش قرار میدهد، توانست رتبه اول را کسب کند. GPT-4.5 در تست IQ نیز عملکرد بهتری نسبت به سایر مدلهای غیر استدلالی موجود در بازار نشان داد. این مدل در معیار نرخ توهم SimpleQA نیز کمترین میزان توهم را در بین مدلهای زبان بزرگ OpenAI به ثبت رساند.
برای مشاهده کامل مطب کلیک کنید
