Anthropic فیلترهای زیستی Fable 5 را سبک‌تر کرد

Anthropic با کاهش حدود ۸۵٪ در نرخ مثبت کاذب فیلترهای ایمنی زیستی مدل زبانی Fable 5، اکنون پاسخ‌های مرتبط با تفسیر نتایج آزمایشگاهی، توضیح علائم بالینی و پرسش‌های پزشکی را مستقیم‌تر ارائه می‌دهد؛ وظایفی که پیش‌تر اغلب مسدود یا به مدل ضعیف‌تر Opus 5 ارجاع می‌شدند.

رابط کاربری Fable 5 و اعلان‌های ایمنی زیستی

چه تغییراتی اعمال شد؟

  • کاهش چشمگیر مثبت‌های کاذب در فیلترها تا حدود ۸۵٪، که موجب پاسخگویی مستقیم‌تر مدل به پرسش‌های تخصصی شد.
  • بهبود طبقه‌بندی متنی برای تشخیص دقیق‌تر پرسش‌های بی‌خطر از آن‌هایی که ریسک‌زا هستند.
  • ادغام سازوکارهای نظارت و آزمون پیش از عرضه تغییرات برای جلوگیری از بروز رفتار ناخواسته.

کدام محدودیت‌ها باقی مانده‌اند؟

Anthropic هنوز دسترسی به حوزه‌های «دو‌منظوره» (dual-use) را محدود نگه داشته است؛ حوزه‌هایی مانند ویروس‌شناسی، توکسیکولوژی و طراحی مولکولی که می‌توانند به بازیگران مخرب توانایی‌هایی بدهند. حفظ این حفاظ‌ها از منظر جلوگیری از سوءاستفاده و کاهش خطر انتشار فناوری‌های زیستی خطرناک ضروری است.

نمونه‌های حوزه‌های محدود

  • تحلیل دقیق ساختار و عملکرد ویروس‌ها
  • روش‌های تولید یا توزیع عوامل سمی
  • طراحی مولکولی که می‌تواند موجب تولید عامل زیستی یا تسهیل گسترش آن شود

چرایی احتیاط Anthropic

یکی از دلایل محوری، دشواری کنترل ریسک‌های زیستی است؛ ویروسی که منتشر شود به‌سادگی قابل «خاموش» کردن نیست و تولید پادزهر یا درمان زمان‌بر است. این رویکرد با گزارش‌ها و تحلیل‌هایی همخوانی دارد که ریسک استفاده از هوش مصنوعی برای طراحی عوامل زیستی خطرناک را نشان داده‌اند. برای مرور مفاهیم مرتبط می‌توان به صفحه Biosecurity مراجعه کرد.

مسیر دسترسی پژوهشگران و برنامه‌های آتی

Anthropic در حال طراحی سازوکارهای کنترل‌شده است تا پژوهشگران واجد شرایط بتوانند تحت نظارت و با محدودیت‌های مشخص از قابلیت‌های حساس بهره ببرند. انتظار می‌رود این برنامه‌ها شامل موارد زیر باشند:

  • فرآیندهای اعتبارسنجی و انتخاب پژوهشگران
  • سامانه‌های ثبت و گزارش‌گیری استفاده (audit trail)
  • نظارت فعال و محدودیت‌های دسترسی مبتنی بر مورد استفاده
  • همکاری با نهادهای نظارتی و جامعه علمی برای بازنگری مستمر سیاست‌ها

پیامدها برای جامعه علمی و توسعه‌دهندگان

  • دسترسی وسیع‌تر به Fable 5 می‌تواند سرعت تحلیل داده‌ها و تفسیر نتایج بالینی را افزایش دهد، در حالی که حوزه‌های پرریسک همچنان کنترل خواهند شد.
  • اعتراض‌های پیشین نسبت به ارجاع خودکار همه پرسش‌های زیستی به مدل ضعیف‌تر باعث شد Anthropic راه میانی را اتخاذ کند: کاستن از مثبت کاذب‌ها بدون حذف کامل حفاظ‌ها.
  • اجرای برنامه‌های دسترسی تحت نظارت احتمالاً نیازمند سازوکارهای اعتبارسنجی، ثبت گزارش استفاده و همکاری بین‌سازمانی خواهد بود.

نگاهی به آینده

کاهش بیش از ۸۰٪ در مثبت‌های کاذب نشان‌دهنده تلاش برای یافتن تعادلی میان کاربردپذیری و ایمنی است. پرسش کلیدی اکنون این است که آیا سازوکارهای نظارتی پیشنهادی می‌توانند هم‌زمان به نیازهای پژوهشی پاسخ دهند و از ظهور خطرات نوپدید جلوگیری کنند. روند توسعه این سازوکارها و واکنش نهادهای علمی و نظارتی تعیین‌کننده مسیر قابل‌قبول استفاده از مدل‌های زبانی در حوزه‌های حساس زیستی خواهد بود.

برای مرور اطلاعات پایه درباره این شرکت می‌توانید به صفحه Anthropic مراجعه کنید و خبرها و تحلیل‌های مرتبط با پروژه‌های دانشگاهی را در Stanford News دنبال کنید.