معرفی GPT-5.6‑Cyber

OpenAI از مدل تخصصی GPT-5.6‑Cyber رونمایی کرده که تحت برنامهٔ Daybreak و از طریق مسیر Daybreak Red در دسترس پژوهشگران امنیتی قرار می‌گیرد. هدف این مدل تسریع شناسایی آسیب‌پذیری‌ها و توسعهٔ زنجیره‌های اکسپلویت به‌منظور پیشگیری از سوء‌استفادهٔ بازیگران تهدید است.

مسیرهای دسترسی Daybreak و شرایط استفاده

  • Daybreak Blue: برای عملیات دفاعی مجاز مانند تحلیل بدافزار، کشف آسیب‌پذیری و پاسخ به حادثه. دسترسی به GPT-5.6 Sol با تدابیر حفاظتی فزاینده همراه است.
  • Daybreak Red: ویژه پژوهشگران امنیتی که روی کشف و اعتبارسنجی اکسپلویت، تست نفوذ و پژوهش آسیب‌پذیری کار می‌کنند و شامل دسترسی به GPT-5.6‑Cyber می‌شود.

ورود به هر مسیر مستلزم احراز هویت، تقویت امنیت حساب، نظارت مستمر و تعهدات حقوقی است. از تاریخ 1 سپتامبر 2026، استفاده از کلیدهای سخت‌افزاری برای همهٔ حساب‌های Daybreak اجباری خواهد بود. OpenAI همچنین پیشنهاد می‌کند جریان‌های کاری را در محیط‌های ایزوله (sandbox) اجرا کرده و از مکانیزم‌های بازبینی خودکار در ابزارهایی مانند Codex پیش از اجرای اقدامات حساس بهره ببرند.

ویژگی‌ها و توانمندی‌های متمایز

GPT-5.6‑Cyber که برپایهٔ GPT-5.6 Sol آموزش یافته، برای وظایف تخصصی امنیتی بهینه‌سازی شده: کشف آسیب‌پذیری‌های روزصفر، تولید زنجیرهٔ اکسپلویت، دورزدن مکانیزم‌های احراز هویت و افزایش امتیاز. در معیار داخلی «Advanced Cybersecurity Completion Rate» این مدل حدود 95% از پرسش‌های حساس را پاسخ داده است؛ در حالی که GPT-5.6 Sol با تدابیر ایمنی روشن حدود 1.5% و نسخهٔ Blue حدود 2% توانسته‌اند پاسخ دهند. نسخهٔ قبلی، GPT-5.5‑Cyber، در این معیار حدود 57.3% عملکرد داشته است.

نتایج آزمایش‌های عملی

در یک سناریوی آزمایشی، از مدل‌ها خواسته شد راهکاری برای عبور از احراز هویت WebSocket یک پنل مدیریتی داخلی توسعه دهند؛ تنها GPT-5.6‑Cyber در مسیر Daybreak Red قادر به تولید کد اکسپلویت عملی شد و سایر نمونه‌ها درخواست را رد کردند. در معیار ExploitGym، که تبدیل آسیب‌پذیری‌های شناخته‌شده به اکسپلویت‌های کاربردی را می‌سنجد، GPT-5.6‑Cyber نیز نسبت به GPT-5.6 Sol و GPT-5.5‑Cyber عملکرد بهتری نشان داد.

نمایی نمادین از عملکرد GPT-5.6-Cyber در تحلیل آسیب‌پذیری

یافته‌های میدانی: کروم و سیستم‌عامل موبایل

OpenAI گزارش می‌دهد که GPT-5.6‑Cyber در پژوهش‌های عملیاتی به کار رفته و موتور JavaScript کروم، V8، را تحلیل کرده است. این تحلیل دو آسیب‌پذیری ناشناخته را شناسایی کرد که امکان زنجیره‌شدن برای آسیب‌رساندن به حافظه و عبور از مرزهای heap در V8 را فراهم می‌ساخت؛ پس از افشای هماهنگ، گوگل این اشکالات را رفع و آن‌ها را با شناسهٔ CVE-2026-15903 ثبت نمود. علاوه بر این، مدل انعکاس داده که حداقل پنج آسیب‌پذیری در یک «سیستم‌عامل محبوب موبایل» یافته شده که یکی از آن‌ها می‌تواند به اپ امکان صعود امتیاز به سطح مدیر و کنترل دستگاه را بدهد.

برای آشنایی بیشتر با طبقه‌بندی آسیب‌پذیری‌ها به CVE مراجعه کنید یا دربارهٔ مفهوم zero-day مطالعه نمایید.

دسترسی مسئولانه و راهبردهای کاهش ریسک

OpenAI با شرکا و جامعهٔ متن‌باز برای افشا و رفع هماهنگ آسیب‌پذیری‌ها همکاری می‌کند و مدل را در سطحی قرار داده که طبق ارزیابی شرکت «بالا» است اما به آستانهٔ «بحرانی» نرسیده است. با این وجود، پیشرفت سریع توانمندی‌های سایبری مدل‌ها نیازمند هم‌راستا کردن سریع‌تر کنترل‌ها و سیاست‌ها است.

توصیه‌های عملی برای تیم‌ها:

  • اجرای تحلیل‌های حساس در محیط‌های جداسازی‌شده (sandbox) و شبکه‌های ایزوله.
  • الزام به استفاده از کلیدهای سخت‌افزاری و احراز هویت چندعاملی برای حساب‌های دارای دسترسی به مدل.
  • پایش و ثبت دقیق تمام تعاملات پژوهشی و اعمال بازبینی انسانی پیش از استقرار نتایج در محیط تولید.
  • همکاری با عرضه‌کنندگان پچ و انجام فرایند افشای هماهنگ هنگام کشف آسیب‌پذیری‌های نوظهور.

پیامدها برای اکوسیستم امنیت

عرضهٔ GPT-5.6‑Cyber نشان می‌دهد رقابت به سمت گسترش مدل‌های تخصصی امنیتی پیش می‌رود؛ ابزارهایی که می‌توانند قدرت مدافعان را افزایش دهند اما در صورت دسترسی سوء‌استفاده‌کنندگان، خطرآفرین باشند. در کوتاه‌مدت، دسترسی کنترل‌شده و پروتکل‌های سختگیرانه برای حساب‌ها و محیط‌های اجرا مهم‌ترین ابزار کاهش ریسک خواهند بود. در بلندمدت، هماهنگی میان توسعه‌دهندگان مدل، پژوهشگران مستقل و سازندگان نرم‌افزار برای فرایندهای افشای امن و رفع سریع آسیب‌پذیری‌ها ضروری است.

منابع مرتبط

برای اطلاعات تکمیلی دربارهٔ OpenAI به صفحهٔ OpenAI مراجعه کنید.

جمع‌بندی: معرفی GPT-5.6‑Cyber فصل تازه‌ای در توازن توانمندی‌های دفاعی و تهاجمی مبتنی بر هوش مصنوعی گشوده است؛ چالشی که سیاست‌ها و روش‌های عملیاتی بخش امنیت را با سرعت بازتعریف خواهد کرد.