شرکت آنتروپیک با معرفی مدل پرچم‌دار جدید خود یعنی کلود اوپوس ۵ (Claude Opus 5)، رقابت در بازار مدل‌های زبانی را به شدت داغ کرده است. این مدل جدید در حوزه‌های کدنویسی و کارهای دانشی بالاترین امتیازات را ثبت کرده و توانسته با نصف نرخ توکنِ مدل گران‌قیمت فِیبِل ۵ (Fable 5)، عملکردی بسیار نزدیک به آن ارائه دهد.

آنتروپیک برای مقابله با فشارهای قیمتی ناشی از مدل GPT-5.6 Sol و رقبای چینی، استراتژی خود را بر پایه کاهش شکاف میان «قیمت» و «عملکرد» بنا کرده است. نسخه اوپوس ۵ اکنون به‌عنوان مدل پیش‌فرض در سرویس Claude Max و توانمندترین مدل در دسترس کاربران Claude Pro شناخته می‌شود.

تفاوت قیمت توکن‌ها در مدل‌های جدید

پنجره زمینه (Context Window) یک میلیون توکنی در این نسخه حفظ شده است. همانند نسل قبلی (اوپاس 4.8)، هزینه استفاده از اوپاس 5 برابر با 5 دلار به ازای هر یک میلیون توکن ورودی و 25 دلار به ازای هر یک میلیون توکن خروجی است. همچنین، آنتروپیک یک «حالت سریع» (Fast Mode) جدید معرفی کرده که سرعت پردازش را 2.5 برابر افزایش می‌دهد، اما هزینه نهایی را دو برابر می‌کند.

مقایسه هزینه توکن‌های ورودی و خروجی در مدل‌های مختلف کلود ۵
مدل توکن ورودی نوشتن کش (5 دقیقه) نوشتن کش (1 ساعت) اصابت و به‌روزرسانی کش توکن خروجی
Claude Fable 5 10 دلار 12.50 دلار 20 دلار 1 دلار 50 دلار
Claude Mythos 5 (دسترسی محدود) 10 دلار 12.50 دلار 20 دلار 1 دلار 50 دلار
Claude Opus 5 5 دلار 6.25 دلار 10 دلار 0.50 دلار 25 دلار

* تمام قیمت‌ها به ازای هر یک میلیون توکن (MTok) محاسبه شده‌اند.

تنظیمات عملکرد؛ تلاش بیشتر لزوماً نتیجه بهتری ندارد

کاربران می‌توانند میان مصرف توکن و سطح عملکرد مدل تعادل ایجاد کنند. پنج تنظیم مختلف با عناوین پایین (low)، متوسط (medium)، بالا (high)، بسیار بالا (xhigh) و حداکثر (max) برای این منظور تعبیه شده است. راهنمای پرامپت‌نویسی آنتروپیک توصیه می‌کند برای کاهش مصرف توکن و تأخیر، استفاده گسترده‌ای از تنظیمات low و medium داشته باشید؛ هرچند برای کدنویسی‌های پیچیده و وظایف عاملی (Agentic)، شروع با سطح xhigh همچنان بهترین انتخاب است.

نمودار عملکرد مدل هوش مصنوعی کلود در سطوح تلاش مختلف

نکته جالب توجه اینجاست که صرف هزینه بیشتر همیشه به معنای خروجی بهتر نیست. اوپاس 5 در بالاترین سطح تلاش (max) و در دو بنچمارک Frontier-Bench v0.1 و شاخص Artificial Analysis Coding Agent Index، امتیازی پایین‌تر از دومین سطح تلاش (xhigh) کسب کرده است.

تسلط بی‌چون‌وچرا در کدنویسی عاملی

بر اساس گزارش‌های رسمی، کلود اوپاس 5 رکوردهای جدیدی را ثبت کرده است. در بنچمارک Frontier-Bench v0.1، این مدل در کدنویسی ترمینال عاملی به امتیاز 43.3 درصد رسیده است؛ یعنی با اختلاف چشمگیری مدل‌های فِیبِل 5 (33.7 درصد)، GPT-5.6 Sol (34.4 درصد) و اوپاس 4.8 (21.1 درصد) را شکست داده است.

همچنین در شاخص کارهای دانشی GDPval-AA v2، اوپاس 5 با کسب امتیاز الوی (Elo) 1861، پیشتاز این دوران است. با این وجود، اوپاس 5 در همه ارزیابی‌ها برنده نیست؛ به‌عنوان مثال، در زمینه وظایف مربوط به سلامت و مسائل حقوقی، مدل‌های فِیبِل 5 و میتوس 5 (Mythos 5) عملکرد بهتری از خود نشان داده‌اند. آنتروپیک همچنین با آگاهی از نیازهای متفاوت بازار، آموزش اوپاس 5 را در حوزه وظایف سایبری متوقف کرده تا تمرکز این مدل را روی کدنویسی و پردازش‌های دانشی به حداکثر برساند.

مقایسه بنچمارک‌های مدل زبانی کلود اوپاس ۵ با رقبا

غافلگیری بزرگ در حل مسائل نوین (ARC-AGI-3)

شاید مهم‌ترین اتفاق در زمینه هوش مصنوعی مولد، نتیجه به‌دست‌آمده از اوپاس 5 در بنچمارک ARC-AGI-3 باشد. این آزمون استاندارد، توانایی حل مسائل کاملاً جدید و دور از الگوهای حفظ‌شده را می‌سنجد. اوپاس 5 در این ارزیابی به امتیاز 30.2 درصد دست یافته است.

این عدد در نگاه اول شاید پایین به نظر برسد، اما زمانی حیرت‌انگیز می‌شود که بدانیم مدل قدرتمند GPT-5.6 Sol تنها توانسته 7.8 درصد امتیاز بگیرد و نسل قبلی کلود (اوپاس 4.8) به رقم حاشیه‌ای 1.5 درصد بسنده کرده است. این جهش چشمگیر نشان‌دهنده نزدیک شدن مدل‌های زبانی به درک عمیق‌تر و استدلال‌های واقعی است.