یکشنبه 4 آذر 1403 – 09:19
محققان چینی مدل زبانی بزرگ LLaVA-o1 را معرفی کردهاند که به عنوان رقیب مدل o1 شرکت OpenAI مطرح شده است.
به گزارش تکناک، این مدل جدید با هدف بهبود تواناییهای استدلال و حل مسئله در مدلهای زبانی بزرگ طراحی شده است و تلاش میکند تا در آزمونهای پیچیده مانند المپیاد ریاضی بینالمللی عملکرد بهتری نسبت به مدلهای قبل از خود نشان دهد.
مدلهای موجود نمیتوانند زنجیرههای منطقی استدلالی ایجاد کنند و اغلب در مسیری گیر میکنند، که مشخص نیست در کدام مرحله قرار دارند و چه مشکلی را باید حل کنند.
این رویکرد برخلاف روشهای کلاسیک، امکان بررسی دقیقتر و کارآمدتر را در هر مرحله فراهم میکند.
پژوهشگران با توجه به محدودیت منابع محاسباتی، این روش را تنها با اندازه پرتو ۲ آزمایش کردند و معتقد هستند که با افزایش اندازه پرتو، بهبودهای بیشتری حاصل خواهد شد.
برای مشاهده کامل مطب کلیک کنید
