
موج عرضه مدلهای جدید در تابستان و ابتدای سپتامبر ۲۰۲۶، بازار هوش مصنوعی مولد را دستخوش تحولی گسترده کرده است.
به گزارش خبرنگار مهر؛ موج عرضه مدلهای جدید در تابستان و ابتدای سپتامبر ۲۰۲۶، بازار هوش مصنوعی مولد را دستخوش تحولی گسترده کرده است. مدل «GPT-6 Astra» در ۳ سپتامبر، «Claude Fable 5.1» در 1 سپتامبر و «Gemini 3.8 Flash» در ۲ سپتامبر عرضه شدند و در هفتههای پیش از آنها نیز «Grok 4.6» و «GLM-5.3» و «Qwen3.8» و «DeepSeek V4» و «Kimi K3» وارد بازار شده بودند. نتیجه این تراکم عرضه، شکلگیری بازاری است که در آن فاصله میان مدلها بیش از گذشته بر اساس نوع کاربرد آنها و مزیتهای فنی آشکار میشود. مدل مناسب برای پژوهش عمیق و کار چندمرحلهای لزوماً بهترین گزینه برای پردازش انبوه اسناد، برنامهنویسی روزمره یا تحلیل صوت و ویدئو نیست. بر همین اساس، گزارش اخیر وبگاه «Teamday» ارزیابی مدلها را بر همین مبنا، با ترکیب توان برنامهنویسی، پژوهش، استفاده از ابزار، کار با رایانه، طول زمینه، هزینه و قابلیت استقرار صورت میدهد.
این تغییر، معیار ارزیابی را از امتیاز خام بنچمارک به توانایی تکمیل یک مأموریت واقعی تغییر داده است. وبگاه «MindsHub» نیز با اتکا به شاخص «Intelligence Index v4.3» مؤسسه تحقیقاتی «Artificial Analysis» تأکید میکند که هزینه هر مأموریت، میزان استدلال، تعداد فراخوانی ابزار و قابلیت کار با انواع ورودیها میتواند نتیجه انتخاب را تغییر دهد. در عمل، سؤال اصلی برای کاربران و سازمانها این است که کدام مدل با کمترین مداخله انسانی، یک خروجی قابل پذیرش را از ابتدا تا انتها تحویل میدهد.
