Anthropic از ۱۴ اوت حالت خودکار را در Claude Code برای کاربران Pro، Max و Team بهصورت پیشفرض فعال میکند تا تصمیمگیری دربارهٔ درخواستهای برنامهنویسی حساس به یک طبقهبندیکنندهٔ مستقل واگذار شود و نیاز به تأیید مداوم انسانها کاهش یابد.
دلیل اتخاذ این تصمیم
تحقیقات داخلی Anthropic نشان میدهد کاربران بهطور میانگین ۹۷٪ درخواستهای اجازه را تأیید میکنند؛ آماری که حاکی از کلیکهای بیپیرایه و احتمالاً بررسی سطحی است. در آزمایشی با بیش از ۱۰۰۰ شرکتکننده، انسانها تنها ۱۳٫۶٪ فرمانهای خطرناک را شناسایی کردند، در حالی که حالت خودکار Claude Code توانست ۸۹٪ این فرمانها را مسدود کند. عملکرد افراد با افزایش طول نشستها کاهش مییابد؛ پس از حدود ۵۰ درخواست، نرخ تشخیص فرمانهای خطرناک به نزدیک ۵٪ رسید.
چگونگی عملکرد حالت خودکار
- طبقهبندیکنندهٔ مستقل: یک مدل جداگانه هر فرمان را ارزیابی میکند و در صورت علامتگذاری، اجرای آن را بلافاصله مسدود میکند تا از نیاز به تأییدهای پیدرپی انسانی جلوگیری شود.
- جستجوی مسیرهای ایمنتر: پس از مسدودسازی، Claude تلاش میکند روشهای دیگری برای رسیدن به هدف پیدا کند یا در صورت لزوم برای تأیید صریح دوباره به کاربر بازگردد.
- بازگشت به حالت دستی: پس از سه مسدودی متوالی یا بیست مسدودی در یک نشست، کنترل مجدداً به کاربر واگذار و بررسیها به حالت دستی برمیگردند.
تقویت امنیت: قواعد «رد سخت» و بررسیهای پیشرفته
Anthropic طبقهبندیکننده را به صورت پیشفرض سختگیرانهتر کرده است؛ بهعنوان مثال اجازهٔ خروج دادهها (مثل ارسال کد یا اسرار به مقصد خارجی) بهطور پیشفرض صادر نمیشود. سازمانها میتوانند قواعد «رد سخت» خود را تعریف کنند تا اقداماتی که هرگز نباید مجاز باشند حتی با درخواست صریح کاربر نیز مسدود بمانند.
طبقهبندیکننده پیش از اجرای عملیاتهای حساس چند بررسی کلیدی انجام میدهد، از جمله:
- بازبینی مقصد عملیاتهایی مانند git push یا ایجاد pull request (عمومی، خصوصی یا مورد اعتماد).
- بررسی وضعیت git مخزن قبل از اجرای دستورهای مخرب مانند
git reset --hard. - تحلیل محتوایی که Claude از صفحات وب، فایلها و ابزارها میکشد تا تلاشهای تزریق پرامپت شناسایی شوند.
نتایج آزمایشهای امنیتی
برای ارزیابی مقاومت، Anthropic یک پایلوت دو هفتهای با تیم قرمز Apollo Research اجرا کرد و حملات ساختگی را در جریانهای کاری واقعی شبیهسازی نمود. پیش از تقویت، طبقهبندیکننده حدود ۱۲٪ از این حملات را از دست میداد؛ پس از سختسازی، این رقم در مجموعهٔ دادههای تستی به ۷٪ کاهش یافت.
در یک آزمایش سفارشیشده توسط یک نهاد ثالث، حالت خودکار Anthropic توانست از عبور ۷۲۰ حمله جلوگیری کند. در همان سنجش، نمونههایی از مدلهای برخی رقبا درصد قابلتوجهی از حملات را عبور دادند. Anthropic تصریح میکند که حالت خودکار سطح ریسک را کاهش میدهد اما صفر نمیکند و برای تغییرات حساس در محیط تولید حضور انسان در حلقه ضروری باقی میماند. برای بررسی بیشتر میتوانید به صفحات Anthropic و OpenAI در ویکیپدیا مراجعه کنید.
قابلیت پیام خصوصی بین نشستها
نشستهای موازی Claude Code اکنون امکان ارسال پیام خصوصی بین همتایان خود را دارند؛ قابلیتی که هماهنگی میان عاملها را تسهیل و انجام کارهای چندنشستۀ بلندمدت را عملیتر میکند.
راهنمای عملی برای توسعهدهندگان و تیمهای امنیت
- در کارهای روزمره و نشستهای طولانی، حالت خودکار میتواند بار نگهبانی مداوم را کاهش دهد و تمرکز تیم را افزایش دهد.
- برای عملیات حیاتی و تغییرات زیرساختی، مراحل تأیید انسانی و چکلیستهای امنیتی باید همچنان برقرار باشند.
- سازمانها باید از قواعد «رد سخت» و بازبینی مقصد مخازن استفاده کنند تا از خروج دادههای حساس جلوگیری شود.
این تحول نشان میدهد روند ایمنسازی عاملهای برنامهنویس به سمت اتوماسیون و طبقهبندی خودکار پیش میرود، اما حفظ تعادل میان سرعت و کنترل انسانی برای محیطهای تولیدی همچنان حیاتی است.





