METR از دو نفوذ امنیتی به سامانههای خود خبر داده است؛ در یکی از آنها کلید API این سازمان افشا شد و طی سه هفته حدود 600000 دلار اعتبار برای عملیات inference مصرف گردید. رخداد دوم مرتبط با یک کمپین هدفگیریشده علیه زیرساختهای عمومی METR بود.
حادثهٔ مارس — افشای کلید API روی نمونهٔ EC2
پژوهشگر METR روی یک نمونهٔ شخصی EC2 ایجنتهایی اجرا میکرد که عمداً پشت احراز هویت گوگل قرار داشتند. در همان نمونه، کلید API حساب دسترسی عمومی METR نگهداری میشد. یکی از اپلیکیشنهای از خانوادهٔ «vibe-coded» بهدلیل آسیبپذیری از نوع fail-open رفتار احراز هویت را غیرفعال کرد و داشبورد هماهنگسازی ایجنتها برای چند روز در معرض اینترنت عمومی قرار گرفت.
بررسی METR نشان میدهد مهاجم با جستوجو در فهرستهای ثبت دامنه و لیستهای شفافیت گواهی (Certificate Transparency) وبسایتهایی با کلیدواژههای مرتبط با LLM یا ایجنتها را شناسایی و کلیدهای احتمالی در معرض را جمعآوری کرده است. پس از پیدا کردن نمونه، مهاجم از یک ایجنت خواست کلید ارائهدهندهٔ مدل را افشا کند، کلید SSH اضافه نمود و با استفاده از مشخصات بهدزدیدهشده اعتبار API را روی مدلهای عمومی مصرف کرد.
METR میگوید اگر آن اعتبارها توسط ارائهدهندهٔ مدل رایگان تأمین نشده بود، صورتحساب حدود 600000 دلار میشد. تأخیر در شناسایی سوءاستفاده مرتبط با اجرای ارزیابیها و آزمایشهای مقیاسبالا با مصرف توکن زیاد و نبود محدودیتهای هزینه برای کلیدها بوده است.
حادثهٔ مه — کمپین خودکار و آسیبپذیری نمایشگر تراسکریپت
رویداد دوم که METR آن را «کمپین حمله خارجی مداوم» توصیف کرده، بهنظر بازیگری با انگیزهٔ مالی مربوط میشود که با اتکا بر ایجنتها عملیات کشف آسیبپذیری را خودکار کرده بود: credential stuffing، درخواستهای ناموفق برای دریافت توکنهای OAuth، اسکن سرویسهای تازهاستقرار یافته و فیشینگ کارکنان.
همزمان یک مکانیسم اجرای پرسوجوهای SQL فقطخواندنی در نمایشگر عمومی تراسکریپت بهطور ناخواسته در دسترس قرار گرفته بود. هرچند پرسوجوها بهطور پیشفرض محدود به دادههای عمومی بودند، یک باگ میتوانست اجازهٔ دسترسی به دادههای منتشرنشدهٔ ارزیابیها را فراهم کند. همچنین گزارشها حاکی از وجود برخی دادههای حساس در پایگاهداده بود که پس از اعلام یک پژوهشگر امنیتی مستقل، API مرتبط آفلاین شد.
بررسیهای METR تاکنون شواهدی دال بر دسترسی مهاجمان به دادههای غیرعمومی نیافته و نشان میدهد آن نقطهپایان صرفاً بهصورت گذرا مورد آزمون قرار گرفته است.
اقدامات اصلاحی METR
- بهروزرسانی سیاستهای نگهداری کلید و مشخصات؛ ممنوعیت نگهداری کلیدها روی زیرساختهای غیرMETR.
- افزایش پایش و مانیتورینگ، افزودن هشدارهای هزینهای (spend alerts) برای کلیدها.
- محدودسازی دسترسیها و جداسازی محیطهای تحقیقاتی از زیرساختهای عمومی.
- استقرار secret managerها و استفاده از اعتبارنامههای کوتاهمدت (short-lived credentials).
- تعامل فعال با پژوهشگران مستقل، پاسخدهی سریع به گزارشهای آسیبپذیری و اجرای برنامههای باگباونتی.
پیشنهادهای عملیاتی برای تیمهای آزمایش و ارزیابی مدل
از تجربهٔ METR چند اقدام عملی برای کاهش خطر توصیه میشود:
- اجتناب از نگهداری کلیدها روی زیرساختهای عمومی: از secret managerها و توکنهای موقت استفاده کنید.
- تعریف محدودیت هزینه و نرخ: برای هر کلید quotas و هشدارهای هزینهای فعال کنید تا سوءاستفاده سریعاً آشکار شود.
- پایش و تحلیل خودکار ترافیک: مصرف توکن را نسبت به خط پایهٔ عملکرد پایش و ناهنجاریها را خودکار اعلان کنید.
- ایزوله کردن محیطها: محیطهای توسعه، تحقیق و تولید را جدا نگه دارید تا رخنه در یک محیط به دیگری منتقل نشود.
- مسیرهای گزارش و انگیزهدهی به پژوهشگران: راههای شفاف برای گزارش آسیبپذیری و برنامههای تشویقی به کشف سریعتر مشکلات کمک میکند.
جمعبندی و چشمانداز
این رخدادها نشان داد حتی سازمانهای تحقیقاتی که روی سنجش ایمن مدلها کار میکنند در برابر حملاتی که با انگیزهٔ مالی طراحی شدهاند آسیبپذیرند. افزایش پایش، پیادهسازی هشدارهای هزینه و اصلاح سیاستهای نگهداری کلیدها، از جمله اقدامات ضروری برای کاهش اثر این تهدیدها هستند. تکرار و گسترش چنین حملاتی فشار بر روندهای امنیتی در زیستبوم توسعه و ارزیابی مدلها را افزایش میدهد؛ بنابراین همکاری میان ارائهدهندگان مدل، پژوهشگران و تیمهای امنیتی برای تعریف استانداردهای حفاظتی و خودکارسازی پاسخ به حادثه ضروری است.





