شرکت Anthropic اعلام کرده که فیلتر سلاح‌های بیولوژیک این شرکت از خرداد ۱۴۰۴ (مه ۲۰۲۵) تا فروردین ۱۴۰۵ (آوریل ۲۰۲۶) غیرفعال بوده و در این بازه زمانی مجموعاً ۱۳۳ میلیون درخواست مربوط به پیمانکاران خارجی بدون اعمال این حفاظ‌ها پردازش شده است. این رخداد پیامدهایی برای امنیت زیستی و مدیریت ریسک در توسعه مدل‌های زبانی دارد.

  • زمان خاموشی: مه ۲۰۲۵ تا آوریل ۲۰۲۶
  • حجم درخواست‌ها: حدود ۱۳۳ میلیون درخواست پیمانکاران خارجی
  • دامنه انسانی: شامل بازخورد انسانی از سوی تقریباً ۵۰٬۰۰۰ نفر

محدوده رخداد و نقش پیمانکاران

براساس گزارش ایمنی Anthropic، این خلأ امنیتی شامل بازخورد انسانی تأمین‌شده توسط حدود ۵۰٬۰۰۰ نفر می‌شد که از طریق پیمانکاران خارجی کار می‌کردند. شرکت می‌گوید فرآیندهای «غربالگری» و نظارت پیمانکاران غالباً ناکافی بوده و به همین دلیل محتوای مرتبط با امنیت زیستی بدون فیلترهای حفاظتی عبور کرده است.

گزارش ایمنی Anthropic و نقص فیلتر زیستی

نتایج بررسی داخلی و واکنش Anthropic

شرکت گزارش کرده که بررسی‌های داخلی نشانه‌ای از سوءاستفاده عملی یا رخداد فاجعه‌بار نیافته‌اند، اما پس از کشف مشکل معیارهای انتخاب و نظارت پیمانکاران را تشدید کرده‌اند و سیاست‌های حفاظتی را بازنگری کرده‌اند. Anthropic همچنین تنظیماتی در طبقه‌بندی‌ها برای مدل Fable 5 ایجاد کرد تا هم از مسدودسازی بیش از حد پژوهش‌های مشروع جلوگیری شود و هم ریسک‌های واقعی کاهش یابد.

اهمیت فیلترهای مرتبط با سلاح‌های بیولوژیک

فیلترهای مربوط به سلاح‌های بیولوژیک و اطلاعات حساس زیستی برای جلوگیری از استخراج، خلاصه‌سازی یا تولید دانش خطرناک توسط مدل‌های زبانی طراحی می‌شوند. این حفاظ‌ها در کاهش احتمال سوءاستفاده در حوزه‌های حساس زیستی و بیوتکنولوژی نقش کلیدی دارند، به‌خصوص وقتی فرایند توسعه مدل شامل بازیگران بیرونی در زنجیره تأمین انسانی باشد.

خطرات عملی نبودن فیلترها

  • افزایش احتمال دسترسی افراد غیرمجاز به دستورالعمل‌ها یا فرمول‌های خطرناک.
  • گسترش اطلاعات حساس در قالب گفتگوها و داده‌های ذخیره‌شده.
  • کاهش اعتماد عمومی و افزایش فشار نظارتی بر شرکت‌های توسعه‌دهنده مدل.

اقدامات پیشنهادی برای کاهش ریسک

اجرای فنی فیلترها کافی نیست؛ سازوکارهای اجرایی، کنترل‌های پیمانکاری و شفافیت در زنجیره تولید بازخورد انسانی باید تقویت شوند. پیشنهادهای کلیدی:

  • بازنگری و سخت‌گیری در گزینش و آموزش پیمانکاران برای اطمینان از صلاحیت، سوابق و انگیزه مناسب افراد.
  • استقرار سامانه‌های مانیتورینگ و هشدار فوری برای کشف خاموشی، کاهش کارایی یا تغییر غیرمترقبه در عملکرد طبقه‌بندها.
  • گزارش‌دهی مستقل و حسابرسی دوره‌ای توسط ناظران بیرونی حوزه بیوسکیوریتی و ایمنی هوش مصنوعی.
  • تعادل میان محافظت و دسترسی پژوهشی تا پژوهش‌های مشروع بیوتکنولوژی بی‌دلیل مسدود نشوند و در عین حال ریسک‌ها مدیریت شوند.

پرسش‌های کلیدی بی‌پاسخ

اگرچه Anthropic مدعی است هیچ سوءاستفاده‌ای مشاهده نشده، اما پرسش‌هایی درباره طول مدت خاموشی فیلتر، دلایل فنی یا سازمانی رخداد و کیفیت شفافیت گزارش‌دهی همچنان باقی است. نهادهای استانداردسازی، دانشگاه‌ها و صنعت باید معیارها و پروتکل‌های روشنی برای پاسخ به چنین حادثه‌هایی تدوین کنند؛ موضوعی که سازمان‌های بین‌المللی مانند سازمان جهانی بهداشت و مراکز پژوهشی زیستی پیگیری می‌کنند.

حفاظت از اطلاعات حساس زیستی در عصر مدل‌های زبانی قدرتمند نیازمند ترکیب فناوری دقیق، مدیریت ریسک سازمانی و شفافیت در فرایندهاست. اجرای این ترکیب پیچیده اما ضروری است تا هم از مخاطرات واقعی جلوگیری شود و هم فضای پژوهش مشروع حفظ گردد.