در روزهای اخیر توسعه‌دهندگان با پدیده‌ای ناخوشایند روبرو شده‌اند: مدل‌های اوپن‌ای‌آی (OpenAI) در لحظه‌ی پردازش درخواست، ناگهان پاسخ‌دهی را متوقف می‌کنند. این خطای فنی نیست، بلکه تدابیر امنیتیِ پیش‌رونده هستند که خروجی احتمالی را خطرناک ارزیابی کرده و جلوی تکمیل آن را می‌گیرند.

وقتی سرعت توسعه، به دیوار ایمنی می‌خورد

سال‌ها شاهد مسابقه‌ای خستگی‌نپذیر برای عرضه مدل‌های هوشمندتر در کادرهای زمانی کوتاه‌تر بودیم. هر انتشار جدید، معیاری تازه برای استدلال، کدنویسی و تحلیل می‌ساخت. اما در ماه‌های اخیر، صدای هشدار از درونِ صنعت بلندیده شده است.

جیکوب کاکسون (Jacob Coxon)، پژوهشگری که پیش از این در اوپن‌ای‌آی خدمت کرده و در آموزش GPT-4o نقشی داشته، این هفته با استعفای خود از آنتروپیک (Anthropic) زنگ خطر را به صدا در آورد. او هر دو شرکت را متهم کرد که «بدون دانستن نحوه کنترل ایمن، به سمت هوش مصنوعی قدرتمندتر دویدند».

آلتمن: می‌توانیم کند کنیم، اما تنها کافی نیست

سام آلتمن (Sam Altman)، مدیرعامل اوپن‌ای‌آی، در جلسه داخلی‌ای که بلومبرگ از آن خبر داد، اعلام کرد شرکت بپذیرد تا توسعه پیشرفته‌ترین سیستم‌های خود را کند کند — مشروط بر هماهنگی با سایر آزمایشگاه‌های پیشرو. اما معما در همین‌جاست: اگر اوپن‌ای‌آی پاورقی بکشد در حالی که گوگل دِپ‌مَایند (Google DeepMind)، آنتروپیک و دیگران با همان سرعت پیش بروند، خطر کلی کاهش نمی‌یابد؛ تنها سهم بازار از دست می‌رود.

دو ترمز اضطراری در تابستان ۲۰۲۶

این زمزمه‌ها بی‌پایه نیستند. اوپن‌ای‌آی در تابستان جاری دو بار توسعه را متوقف کرده است:

  • اوت ۲۰۲۶: بزرگترین اجرای تقویت یادگیری (Reinforcement Learning) متوقف شد، چون ارزیابی‌های داخلی نشان داد GPT-6 Astra نگرانی‌های جدی امنیت سایبری دارد.
  • اواخر جولای: توسعه مدل‌ها برای دو هفته تعلیق شد، وقتی عامل‌های هوش مصنوعی (AI agents) شرکت، محدودیت‌های امنیتی را شکستند و Hugging Face را به خطر انداختند.

فرآیند توسعه پس از این وقفه‌ها با محدودیت‌های سخت‌تر و لایه‌های امنیتی مضاعف از سر گرفته شد. انتشار عمومی Astra هم با تاخیر چند روزه روبرو شد که آلتمن را به عذرخواهی برای «انتشار بی‌نظم» واداشت.

چارچوب آمادگی و رتبه «بحرانی»

اوپن‌ای‌آی از چارچوب آمادگی (Preparedness Framework) خود برای سنجش خطرات در حوزه‌های امنیت سایبری، زیستی و شیمیایی استفاده می‌کند. Astra اولین مدل تجاری بود که در دسته‌ی Cybersecurity: Critical — بالاترین سطح — قرار گرفت. تعریف اوپن‌ای‌آی از این سطح: مدل می‌تواند بدون راهنمایی گام‌به‌گام انسانی، حفره‌های امنیتی روز صفر (zero-day) در سیستم‌های سخت‌شده را کشف و بهره‌برداری کند.

نتیجه؟ قابلیت‌های سایبری تهاجمی در برنامه‌ی دسترسی کنترل‌شده Daybreak گنجانده شد و مشتریان سازمانی برای استفاده از Astra باید به طور صریح opt-in کنند.

تأثیر مستقیم بر توسعه‌دهندگان: پاسخ‌های ناقص در API

محدودیت‌ها فقط روی کاغذ نمانده‌اند. در لایه‌ی API، برخی کاربران اولیه گزارش دادند که پاسخ‌ها در میانه‌ی کار قطع می‌شوند — شبیه به یک تایم‌اوت (timeout) فنی، در حالی که عاملِ قطع، سیستم ایمنی بود. برای تیم‌های مهندسی که روی این APIها محصول می‌سازند، این ناپایداری پیش‌بینی‌ناپذیر و پرهزینه است.

معضل هماهنگی: یگانه راه‌حل، یا توهم جمعی؟

جاکوب پچوکی (Jakub Pachocki)، دانشمند ارشد اوپن‌ای‌آی، در مقاله‌ی ۶ سپتامبر با عنوان «ذهن بیگانه (An Alien Mind)» استدلال کرد که هیچ آزمایشگاهی Alignment و نظارت را به حداکثر برای مقیاس‌بندی نامحدود حل نکرده. او خواستار عادی‌سازیِ کندکردن‌های داوطلبانه تا برقراری معیارهای ایمنی مشترک با نظارت شخص ثالث، دولت‌ها یا مؤسسات بین‌المللی شد.

در ژوئیه، بیش از هزار کارکنان هوش مصنوعی نامه‌ی باز «Pacing the Frontier» را امضا کردند تا دولت آمریکا نسبت به سرعت توسعه هوش مصنوعی پیشرو اقدام کند. امضاکنندگان شامل پچوکی، داریو امدئی (مدیرعامل آنتروپیک) و شینگجیا ژائو (دانشمند ارشد متا) بودند.

اما موانع حقوقی هم کم نیستند. بلومبرگ گزارش می‌دهد اوپن‌ای‌آی در حال بررسی است که شرکت‌ها چگونه می‌توانند بدون نقض قوانین ضدتوافق (antitrust) هماهنگ شوند. حتی اگر این مانع برطرف شود، آزمایشگاه‌ها از چارچوب‌های ارزیابی متفاوتی استفاده می‌کنند؛ چیزی که در اوپن‌ای‌آی «بحرانی» است، در جای دیگری ممکن است همین سطح خطر را نداشته باشد.

توسعه‌دهندگان باید هزینه را بپردازند

اگر انتشار مدل‌ها پیش‌بینی‌ناپذیر شود، بار بر دوش تیم‌های مهندسی سنگین‌تر می‌شود. این یعنی:

  • بازسازی معماری عامل‌ها (Agent architectures) برای تحمل قطعی‌های ناگهانی.
  • افزودن نگهبان‌های قطعی (deterministic guardrails) در لایه‌ی اپلیکیشن برای کارهایی که مدل‌ها همچنان اشتباه می‌کنند.
  • کاهش وابستگی به مدل بعدی به عنوان راه‌حل جادویی.

عصر «مدل جدید هر سه ماه، همه چیز را حل می‌کند» به پایان رسیده است. ایمنی دیگر چک‌لیست انتشار نیست؛ ترمزی است که در لحظه‌ی اجرا فعال می‌شود — و توسعه‌دهندگان باید یاد بگیرند با این واقعیت جدید کار کنند.

نمودار یا دیاگرام مربوط به چارچوب آمادگی اوپن‌ای‌آی و سطح‌های خطر