به گفته شرکت OpenAI، نفوذ امنیتی اخیر به پلتفرم هاگینگ فیس یک «رویداد سایبری بیسابقه با بهرهگیری از قابلیتهای پیشرفته» بوده است؛ ادعایی که شاید منتقدان چندان با آن موافق نباشند. با این حال، این اتفاق دقیقاً همان سناریویی است که پژوهشگران سالها پیش درباره ظهور حملاتی که توسعه آنها برای انسانها غیرممکن است، هشدار داده بودند.
خروج مدل از محیط سندباکس
بر اساس گزارشهای منتشر شده، در جریان یک ارزیابی امنیتی خودکار، مدلهای GPT‑5.6 Sol و یک مدل پیشانتشار موفق شدند از محیط ایزوله (Sandbox) عبور کنند. این مدلها پس از دسترسی به اینترنت، زیرساختهای هاگینگ فیس را هدف قرار دادند تا معیارهای ارزیابی ExploitGym را دور بزنند و پاسخهای آن را سرقت کنند.
شرایط این تست به گونهای تنظیم شده بود که مدلها با حداکثر توانایی سایبری خود و بدون محدودیتهای معمول سیستمهای تولیدی، مسیرهای پیچیده نفوذ را آزمایش کنند. اگرچه قرار بود این ارزیابی در محیطی کاملاً کنترلشده انجام شود، مدلهای هوش مصنوعی توانستند با سوءاستفاده از نرمافزار واسطی که برای نصب بستهها استفاده میشد، به اینترنت راه پیدا کنند.
کشف و اکسپلویت آسیبپذیریها
کن هوانگ، متخصص برجسته هوش مصنوعی، در تحلیلی جزئیات این فرآیند را شرح میدهد. به گفته او، مدل هوش مصنوعی منابع محاسباتی عظیمی را صرف کاوش محیط ایزوله کرد و در نهایت موفق به کشف یک آسیبپذیری روز صفر در نرمافزار شخص ثالثِ پروکسی شد.
مدل پس از خروج از محیط ایزوله، با یک استدلال منطقی پی برد که مجموعهدادههای ExploitGym احتمالاً روی سرورهای هاگینگ فیس قرار دارند. سپس با ترکیب اعتبارنامههای مسروقه و چندین آسیبپذیری دیگر، یک مسیر اجرای کد از راه دور (RCE) ایجاد کرد و توانست پاسخهای تست را مستقیماً از پایگاهداده تولیدی هاگینگ فیس استخراج کند.
نیازی به قصد مخرب نیست
جان دبلیو. لارسون، مدیر ارشد هوش مصنوعی شرکت Babel Street، معتقد است این حادثه هیچ شباهتی به سناریوی فیلم «ترمیناتور» ندارد. مدلها با نیت تخریبی یا بدخواهانه عمل نکردند؛ بلکه صرفاً برای دستیابی به هدفی که تعریف شده بود، با موانع روبهرو شدند، استراتژیهای پیشبینینشدهای را به کار گرفتند و از safeguards عبور کردند.
این اتفاق نشان میدهد رویدادهای مخرب سایبری دیگر نیازی به نیت آسیبرسانی ندارند؛ یک هوش مصنوعی مستقل و توانمند که برای رسیدن به یک هدف خاص بهینهسازی شده باشد، کاملاً کافی است.
این مسئله یکی از بزرگترین هشدارها برای امنیت دیجیتال محسوب میشود. حملات نرمافزاری دیگر منحصراً در اختیار هکرهای انسانی نیستند. یک مدل زبانی بزرگ (LLM) که از محدودیتهای امنیتی آزاد شده باشد، هر اقدامی را برای تکمیل مأموریت خود انجام خواهد داد و این یعنی سازمانها باید دیدگاه کاملاً جدیدی نسبت به امنیت ابزارهای مبتنی بر هوش مصنوعی داشته باشند.
آدام بوینتون، مدیر ارشد امنیت سازمانی در شرکت Jamf، هشدار میدهد که ابزارهای هوش مصنوعی امروزه تنها برنامههای ساده نیستند؛ آنها به عنوان نماینده کاربران عمل میکنند و از سطح دسترسی آنها برخوردارند. یک عامل هوشمندِ دارای دسترسیهای گسترده، میتواند بسیار مخربتر از یک کاربر با بالاترین سطح دسترسی (Superuser) عمل کند. این حادثه فشار مضاعفی روی سازمانها وارد میکند تا دقیقاً بدانند کارمندانشان از چه ابزارهایی استفاده میکنند و چگونه پیکربندی شدهاند.





