هفته گذشته OpenAI با انتشار GPT-5.6 و ادغام Codex در یک اپلیکیشن دسکتاپ یکپارچه ChatGPT، موجی از-transform در اکوسیستم توسعه‌دهندگان ایجاد کرد. تنها در عرض چند روز، تعداد کاربران فعال مشترک Codex و ChatGPT Work از مرز ۸ میلیون نفر عبور کرد — روندی که تیبو سوتیا، رهبر مهندسی Codex، آن را «شگفت‌انگیز» توصیف می‌کند.

شوک رشد: از ۱ میلیون به ۸ میلیون در کمتر از ۶ ماه

بر اساس آمارهای داخلی OpenAI:

  • فبریه ۲۰۲۶: کمتر از ۱ میلیون کاربر فعال هفتگی
  • اوائل ژوئن: رسیدن به ۵ میلیون کاربر
  • ۹ ژوئیه ( انتشار GPT-5.6): شتاب یافتن منحنی رشد
  • ۱۲ ژوئیه: ۶ میلیون کاربر
  • ۱۳ ژوئیه (۲۴ ساعت بعد): ۷ میلیون کاربر
  • یکشنبه ۱۵ ژوئیه: ۸ میلیون کاربر

این منحنی رشد، حتی برای استانداردهای SaaS سازمانی، بی‌سابقه است. سوتیا در پست خود در X اشاره کرد که این ترازش هم‌زمان با رشد چشمگیر استفاده از Anthropic Claude در سال ۲۰۲۶ رخ داده است.

نمودار رشد کاربران Codex و ChatGPT Work در سال ۲۰۲۶

چه اتفاقی در روز انتشار افتاد؟

OpenAI در یک روز سه حرکت استراتژیک انجام داد:

  1. ادغام اپلیکیشن مستقل Codex در اپلیکیشن دسکتاپ ChatGPT
  2. راه‌اندازی ChatGPT Work به عنوان یک حالت عاملان‌محور (Agentic) برای کارکنان دانش
  3. شروع منسوخ‌سازی تدریجی مرورگر Atlas

نتیجه؟ ترافیک به شدت افزایش یافت — تقریباً دو برابر پک ترافیکی پیشین OpenAI در ۴۸ ساعت. این ورودی ناگهانی چندین چالش مقیاس‌پذری را آشکار کرد که تیم مهندسی باید به سرعت مدیریت می‌کرد.

اقدامات فوری تیم مهندسی

در یک رشته جزئی (Thread) در ۱۲ ژوئیه، سوتیا راهکارهای زیر را تشریح کرد:

  • بهینه‌سازی استنتاج (Inference) برای افزایش ظرفیت حدود ۱۰٪ در هر مشترک
  • کاهش پنجره متن (Context Window) از ۳۷۲،۰۰۰ به ۲۷۲،۰۰۰ توکن — تصمیم ناشی از مشکلات صورتحساب غیرمنتظره‌ای که محدودیت بزرگتر ایجاد کرده بود
  • برگرداندن تنظیمات استدلال تجربی (داخلی با نام «juice values» شناخته می‌شدند)
  • اصلاح رفتار بیش‌ازحد پرخاشگرانه سیستم‌های چند عامله (Multi-agent) در بالاترین سطوح استدلال

علاوه بر این، OpenAI به طور موقت سقف استفاده پنج ساعته برای مشترکین Plus، Business و Pro را برداشت — گسترده‌ترین دسترسی از زمان راه‌اندازی محصول.

واکنش جامعه و موضع‌گیری سم التمن

واکنش‌ها دو قطبی بود: بخشی کاهش پنجره متن را یک «کاهش پنهان» (Stealth Downgrade) خواندند، در حالی که دیگران شفافیت سوتیا در توضیح مقیاس‌های عملیاتی را تحسین کردند. سم التمن، مدیرعامل OpenAI، با بیانیه‌ای وارد عمل شد که به نظر می‌رسید موضع‌گیری در برابر رقبایی باشد که به زعم او «کاربران را با تحقیر می‌نشینند».

رقبا چگونه پاسخ دادند؟

تنها چند ساعت پس از اعلام میله‌ पत्थر ۷ میلیونی OpenAI، Anthropic دو حرکت انجام داد:

  • تمدید قیمت تبلیغاتی Claude Fable 5 تا ۱۹ ژوئیه
  • افزایش ۵۰٪ محدودیت‌های استفاده هفتگی Claude Code

همزمان، GPT-5.6 Sol در جدول رتبه‌بندی عاملان (Agent Leaderboard) پلتفرم Arena به رتبه دوم ارتقا یافت، پس از ۷،۸۰۰ جلسه عاملان واقعی. بسیاری از توسعه‌دهندگان اکنون OpenAI را مجدداً رهبر در حوزه کدنویسی با هوش مصنوعی می‌دانند.

هزینه در هر وظیفه (Cost per Task): معیار واقعی ارزیابی

توسعه‌دهندگان سیستم‌ها را نه بر اساس قیمت توکن، بلکه بر اساس هزینه تکمیل یک وظیفه قضاوت می‌کنند. گزارش Cognition در مورد Devin Fusion (قدرت‌گرفته با Fable 5) آشکار کرد:

در ۸۱٪ از اجرای‌های هدایت‌شده توسط Fable، مدل اصلی هرگز کد را ویرایش نمی‌کند. تفویض بهتر (Delegation) کارهای غیرضروری را کاهش داده و در نتیجه، حتی با مدل گران‌تر، هزینه کلی وظیفه پایین‌تر می‌آید.

این نکته کلیدی است: یک مدل گران‌تر می‌تواند هزینه‌های کلی را کاهش دهد اگر از کارهای هدر رفته جلوگیری کند.

ابزار اجرای (Harness) در حال تبدیل به محصول اصلی است

تصمیم OpenAI برای ادغام Codex، ChatGPT Work و مرورگر داخلی در یک اپلیکیشن دسکتاپ واحد، تغییر پارادایم را منعکس می‌کند: محوریت از مدل به سمت «محیط اجرا و ابزارها» جابجا شده است.

معماری پلاگین جدید، اپلیکیشن را به Slack، Google Drive، SharePoint، CRMها و تقویم‌ها متصل می‌کند. OpenAI در حال ساخت یک Workspace (فضای کار) است که بر ابزارهای موجود کاربران سوار می‌شود، نه جایگزین آن‌ها.

Anthropic با Claude Cowork در جهت مشابهی حرکت کرده، پس از اینکه متوجه شد کاربران از Claude Code برای کارهای فراتر از توسعه نرم‌افزار استفاده می‌کنند.

سقف‌های استفاده: گلوگاه باقی‌مانده

با وجود برداشتن محدودیت پنج ساعته، Codex و ChatGPT Work همچنان یک سهمیه هفتگی واحد را به اشتراک می‌گذارند. اجرای جلسه سنگین Sol Ultra با آرکستراسیون چند عامله، این سهمیه را به سرعت خالی می‌کند. سوتیا از این مشکل آگاه است و راه‌حلی در دست کار است.

پیش‌بینی‌های نزدیک

  • جداسازی سهمیه‌های Codex و ChatGPT Work در آپدیت‌های آتی
  • افزایش تدریجی پنجره متن با حل مشکلات بیلینگ
  • رقابت شدیدتر بر سر «هزینه در هر وظیفه» نه «قیمت توکن»
  • توسعه اکوسیستم پلاگین‌ها به عنوان مزیت رقابتی اصلی

برای توسعه‌دهندگان، پیام ساده است: ابزارها در حال trưởngیت یافتن هستند، و برنده кого خواهد بود که بهتر درWorkflow موجود کاربر ادغام شود، نه فقط مدل هوشمندتر داشته باشد.

مدیریت این حجم ترافیک و چالش‌های مقیاس‌پذیری، نیازمند معماری‌های پایه‌ای استوار در سیستم‌های هوش مصنوعی است. برای درک عمیق‌تر این مبناها، مقاله مقیاس‌پذیری هوش مصنوعی را مطالعه کنید.