Anthropic از ۱۴ اوت حالت خودکار را در Claude Code برای کاربران Pro، Max و Team به‌صورت پیش‌فرض فعال می‌کند تا تصمیم‌گیری دربارهٔ درخواست‌های برنامه‌نویسی حساس به یک طبقه‌بندی‌کنندهٔ مستقل واگذار شود و نیاز به تأیید مداوم انسان‌ها کاهش یابد.

دلیل اتخاذ این تصمیم

تحقیقات داخلی Anthropic نشان می‌دهد کاربران به‌طور میانگین ۹۷٪ درخواست‌های اجازه را تأیید می‌کنند؛ آماری که حاکی از کلیک‌های بی‌پیرایه و احتمالاً بررسی سطحی است. در آزمایشی با بیش از ۱۰۰۰ شرکت‌کننده، انسان‌ها تنها ۱۳٫۶٪ فرمان‌های خطرناک را شناسایی کردند، در حالی که حالت خودکار Claude Code توانست ۸۹٪ این فرمان‌ها را مسدود کند. عملکرد افراد با افزایش طول نشست‌ها کاهش می‌یابد؛ پس از حدود ۵۰ درخواست، نرخ تشخیص فرمان‌های خطرناک به نزدیک ۵٪ رسید.

چگونگی عملکرد حالت خودکار

  • طبقه‌بندی‌کنندهٔ مستقل: یک مدل جداگانه هر فرمان را ارزیابی می‌کند و در صورت علامت‌گذاری، اجرای آن را بلافاصله مسدود می‌کند تا از نیاز به تأییدهای پی‌درپی انسانی جلوگیری شود.
  • جستجوی مسیرهای ایمن‌تر: پس از مسدودسازی، Claude تلاش می‌کند روش‌های دیگری برای رسیدن به هدف پیدا کند یا در صورت لزوم برای تأیید صریح دوباره به کاربر بازگردد.
  • بازگشت به حالت دستی: پس از سه مسدودی متوالی یا بیست مسدودی در یک نشست، کنترل مجدداً به کاربر واگذار و بررسی‌ها به حالت دستی برمی‌گردند.

تقویت امنیت: قواعد «رد سخت» و بررسی‌های پیشرفته

Anthropic طبقه‌بندی‌کننده را به صورت پیش‌فرض سخت‌گیرانه‌تر کرده است؛ به‌عنوان مثال اجازهٔ خروج داده‌ها (مثل ارسال کد یا اسرار به مقصد خارجی) به‌طور پیش‌فرض صادر نمی‌شود. سازمان‌ها می‌توانند قواعد «رد سخت» خود را تعریف کنند تا اقداماتی که هرگز نباید مجاز باشند حتی با درخواست صریح کاربر نیز مسدود بمانند.

طبقه‌بندی‌کننده پیش از اجرای عملیات‌های حساس چند بررسی کلیدی انجام می‌دهد، از جمله:

  • بازبینی مقصد عملیات‌هایی مانند git push یا ایجاد pull request (عمومی، خصوصی یا مورد اعتماد).
  • بررسی وضعیت git مخزن قبل از اجرای دستورهای مخرب مانند git reset --hard.
  • تحلیل محتوایی که Claude از صفحات وب، فایل‌ها و ابزارها می‌کشد تا تلاش‌های تزریق پرامپت شناسایی شوند.
معماری حالت خودکار Claude Code و طبقه‌بندی‌کننده امنیتی

نتایج آزمایش‌های امنیتی

برای ارزیابی مقاومت، Anthropic یک پایلوت دو هفته‌ای با تیم قرمز Apollo Research اجرا کرد و حملات ساختگی را در جریان‌های کاری واقعی شبیه‌سازی نمود. پیش از تقویت، طبقه‌بندی‌کننده حدود ۱۲٪ از این حملات را از دست می‌داد؛ پس از سخت‌سازی، این رقم در مجموعهٔ داده‌های تستی به ۷٪ کاهش یافت.

در یک آزمایش سفارشی‌شده توسط یک نهاد ثالث، حالت خودکار Anthropic توانست از عبور ۷۲۰ حمله جلوگیری کند. در همان سنجش، نمونه‌هایی از مدل‌های برخی رقبا درصد قابل‌توجهی از حملات را عبور دادند. Anthropic تصریح می‌کند که حالت خودکار سطح ریسک را کاهش می‌دهد اما صفر نمی‌کند و برای تغییرات حساس در محیط تولید حضور انسان در حلقه ضروری باقی می‌ماند. برای بررسی بیشتر می‌توانید به صفحات Anthropic و OpenAI در ویکی‌پدیا مراجعه کنید.

قابلیت پیام خصوصی بین نشست‌ها

نشست‌های موازی Claude Code اکنون امکان ارسال پیام خصوصی بین همتایان خود را دارند؛ قابلیتی که هماهنگی میان عامل‌ها را تسهیل و انجام کارهای چندنشستۀ بلندمدت را عملی‌تر می‌کند.

راهنمای عملی برای توسعه‌دهندگان و تیم‌های امنیت

  • در کارهای روزمره و نشست‌های طولانی، حالت خودکار می‌تواند بار نگهبانی مداوم را کاهش دهد و تمرکز تیم را افزایش دهد.
  • برای عملیات حیاتی و تغییرات زیرساختی، مراحل تأیید انسانی و چک‌لیست‌های امنیتی باید همچنان برقرار باشند.
  • سازمان‌ها باید از قواعد «رد سخت» و بازبینی مقصد مخازن استفاده کنند تا از خروج داده‌های حساس جلوگیری شود.

این تحول نشان می‌دهد روند ایمن‌سازی عامل‌های برنامه‌نویس به سمت اتوماسیون و طبقه‌بندی خودکار پیش می‌رود، اما حفظ تعادل میان سرعت و کنترل انسانی برای محیط‌های تولیدی همچنان حیاتی است.