Anthropic فیلترهای زیستی Fable 5 را سبکتر کرد
Anthropic با کاهش حدود ۸۵٪ در نرخ مثبت کاذب فیلترهای ایمنی زیستی مدل زبانی Fable 5، اکنون پاسخهای مرتبط با تفسیر نتایج آزمایشگاهی، توضیح علائم بالینی و پرسشهای پزشکی را مستقیمتر ارائه میدهد؛ وظایفی که پیشتر اغلب مسدود یا به مدل ضعیفتر Opus 5 ارجاع میشدند.
چه تغییراتی اعمال شد؟
- کاهش چشمگیر مثبتهای کاذب در فیلترها تا حدود ۸۵٪، که موجب پاسخگویی مستقیمتر مدل به پرسشهای تخصصی شد.
- بهبود طبقهبندی متنی برای تشخیص دقیقتر پرسشهای بیخطر از آنهایی که ریسکزا هستند.
- ادغام سازوکارهای نظارت و آزمون پیش از عرضه تغییرات برای جلوگیری از بروز رفتار ناخواسته.
کدام محدودیتها باقی ماندهاند؟
Anthropic هنوز دسترسی به حوزههای «دومنظوره» (dual-use) را محدود نگه داشته است؛ حوزههایی مانند ویروسشناسی، توکسیکولوژی و طراحی مولکولی که میتوانند به بازیگران مخرب تواناییهایی بدهند. حفظ این حفاظها از منظر جلوگیری از سوءاستفاده و کاهش خطر انتشار فناوریهای زیستی خطرناک ضروری است.
نمونههای حوزههای محدود
- تحلیل دقیق ساختار و عملکرد ویروسها
- روشهای تولید یا توزیع عوامل سمی
- طراحی مولکولی که میتواند موجب تولید عامل زیستی یا تسهیل گسترش آن شود
چرایی احتیاط Anthropic
یکی از دلایل محوری، دشواری کنترل ریسکهای زیستی است؛ ویروسی که منتشر شود بهسادگی قابل «خاموش» کردن نیست و تولید پادزهر یا درمان زمانبر است. این رویکرد با گزارشها و تحلیلهایی همخوانی دارد که ریسک استفاده از هوش مصنوعی برای طراحی عوامل زیستی خطرناک را نشان دادهاند. برای مرور مفاهیم مرتبط میتوان به صفحه Biosecurity مراجعه کرد.
مسیر دسترسی پژوهشگران و برنامههای آتی
Anthropic در حال طراحی سازوکارهای کنترلشده است تا پژوهشگران واجد شرایط بتوانند تحت نظارت و با محدودیتهای مشخص از قابلیتهای حساس بهره ببرند. انتظار میرود این برنامهها شامل موارد زیر باشند:
- فرآیندهای اعتبارسنجی و انتخاب پژوهشگران
- سامانههای ثبت و گزارشگیری استفاده (audit trail)
- نظارت فعال و محدودیتهای دسترسی مبتنی بر مورد استفاده
- همکاری با نهادهای نظارتی و جامعه علمی برای بازنگری مستمر سیاستها
پیامدها برای جامعه علمی و توسعهدهندگان
- دسترسی وسیعتر به Fable 5 میتواند سرعت تحلیل دادهها و تفسیر نتایج بالینی را افزایش دهد، در حالی که حوزههای پرریسک همچنان کنترل خواهند شد.
- اعتراضهای پیشین نسبت به ارجاع خودکار همه پرسشهای زیستی به مدل ضعیفتر باعث شد Anthropic راه میانی را اتخاذ کند: کاستن از مثبت کاذبها بدون حذف کامل حفاظها.
- اجرای برنامههای دسترسی تحت نظارت احتمالاً نیازمند سازوکارهای اعتبارسنجی، ثبت گزارش استفاده و همکاری بینسازمانی خواهد بود.
نگاهی به آینده
کاهش بیش از ۸۰٪ در مثبتهای کاذب نشاندهنده تلاش برای یافتن تعادلی میان کاربردپذیری و ایمنی است. پرسش کلیدی اکنون این است که آیا سازوکارهای نظارتی پیشنهادی میتوانند همزمان به نیازهای پژوهشی پاسخ دهند و از ظهور خطرات نوپدید جلوگیری کنند. روند توسعه این سازوکارها و واکنش نهادهای علمی و نظارتی تعیینکننده مسیر قابلقبول استفاده از مدلهای زبانی در حوزههای حساس زیستی خواهد بود.
برای مرور اطلاعات پایه درباره این شرکت میتوانید به صفحه Anthropic مراجعه کنید و خبرها و تحلیلهای مرتبط با پروژههای دانشگاهی را در Stanford News دنبال کنید.





