
به گزارش خبرگزاری خبرآنلاین و براساس گزارش هوشیو، جدول زیر نشان میدهد که Opus ۴.۸ در آزمونهای کدنویسی، مهارتهای عاملمحور، استدلال و وظایف عملی کارهای دانشمحور، در مقایسه با نسخه پیشین خود و سایر مدلها چگونه عمل میکند.

آزمایشکنندگان اولیه دریافتهاند که Claude Opus ۴.۸ در هنگام انجام وظایف عاملمحور، قابلاعتمادتر بوده و در قضاوتهای خود دقیقتر عمل میکند. یکی از برجستهترین بهبودها در Opus ۴.۸ صداقت آن است. اما یک مشکل عمومی در مدلهای هوش مصنوعی این است که گاهی اوقات شتابزده نتیجهگیری میکنند و با وجود شواهد اندک، با اطمینان مدعی پیشرفت در کار خود میشوند. آزمایشکنندگان اولیه گزارش میدهند که احتمال بیشتری وجود دارد تا Opus ۴.۸ عدم قطعیتهای مربوط به کار خود را نشانهگذاری (flag) کند و احتمال کمتری دارد که ادعاهای بدون پشتوانه مطرح کند. این موضوع در ارزیابیهای آنتروپیک نیز به اثبات رسیده است؛ ارزیابیهایی که نشان میدهند احتمال اینکه Opus ۴.۸ اجازه دهد نقصهملکرد بهتری را ارائه میدهد. کاربران میتوانند گزینههای extra یا xhigh در Claude Code یا max را انتخاب کنند تا مدل برای دستیابی به نتایج بهتر، توکنهای بیشتری را مصرف کند. آنتروپیک استفاده از گزینه extra را برای وظایف دشوار و جریانهای کاری ناهمگام (asynchronous workflows) با اجرای طولانی توصیه میکند. محدودیتهای نرخ در Claude Code نیز افزایش یافته تا با مصرف بالاترِ توکن در سطوحِ تلاشِ بالاتر سازگار شود؛ کاربران میتوانند هر گزینهای را که برای پروژه خاص آنها منطقی به نظر میرسد، انتخاب کنند.
دسترسی
Opus ۴.۸ از هماکنون در سراسر اکوسیستم Claude در دسترس است. قیمتگذاری برای استفاده معمولی نسبت به نسخه قبلی بدون تغییر باقی مانده است: ۵ دلار بهازای هر یک میلیون توکن ورودی و ۲۵ دلار بهازای هر یک میلیون توکن خروجی. قیمتگذاری برای حالت سریع برابر با ۱۰ دلار بهازای هر یک میلیون توکن ورودی و ۵۰ دلار بهازای هر یک میلیون توکن خروجی است. توسعهدهندگان نیز میتوانند از طریق Claude API از مدل Opus ۴.۸ استفاده کنند.
۲۲۷۲۲۷
