مایکروسافت دیروز «قاعدة‌نامه رفتار هوش‌مصنوعی» خود را به انتشار رساند؛ سندی که خطوط‌قرمز نامگزبر برای مدل‌های این شرکت ترسیم می‌کند. این گام در أعقاب بروز رفتارهای غیرمنتظره در عامل‌های هوشمند (rogue agents) و نگرانی‌های فزاینده درباره هم‌سازی (alignment) سیستم‌های پیشرفته برداشته شده است.

محدودیت‌های مطلق: از هک و سلاح هسته‌ای تا دیپ‌فیک و گریز از نظارت

قاعدة‌نامه جدید هر مدل هوش‌مصنوعی مایکروسافت (MAI) را ملزم می‌سازد که در چارچوبی فراگیر عمل کند که بر ترجیحات کاربران یا وظایف خاص اولویت دارد. ستون فقرات این سند، «محدودیت‌های مطلق» است که موارد زیر را به صراحت منع می‌کند:

  • انجام حملات سایبری و نفوذ به سیستم‌ها
  • تولید یا تسهیل سلاح‌های هسته‌ای
  • ساخت محتوای دیپ‌فیک برای فریب‌دادن
  • هر مکانیزم تطبیقی، فریبنده، تقویت‌کننده‌خود یا توطئه‌آمیز برای گریز از نظارت انسانی

به زبان سند: «مدل‌های MAI نخواهند توانست از مکانیزم‌هایی برای شکست دادن نظارت انسانی استفاده کنند، به‌گونه‌ای که دیگر به‌طور قابل‌اطمینانی توسط افراد یا سیستم‌های مجاز قابل هدایت، تغییر یا خاموش شدن نباشند.»

پیش‌بینی ده‌ساله: ظهور فوق‌هوش‌مصنوعی و چالش تاریخی بشر

سند با پیش‌بینیی آغاز می‌شود که در ده سال آینده، سیستم‌های فوق‌هوش‌مصنوعی در اکثر وظایف از عملکرد انسانی برتری خواهند یافت. مایکروسافت این چالش را «یکی از بزرگترین چالش‌های بشر در تاریخ» توصیف کرده و تأکید دارد که شفافیت در هدف اختراع و روش کنترل این سیستم‌ها، لزومی غیرقابل‌انکار است.

هم‌سویی با استراتژی «کنترل سرعت پیشرفت در مرزهای پیشرو»

انتشار این قاعدة‌نامه در میانه توافق گسترده‌ای بین بازیگران پیشرو صنعت — Anthropic، OpenAI، xAI و خود مایکروسافت — درباره ضرورت «کنترل سرعت پیشرفت در مرزهای پیشرو» (pacing the frontier) اتفاق می‌افتد. ساتیا نادلا، مدیرعامل مایکروسافت، در این باره بیان داشت: «ما از تحقیقات، تمرکز و کنترل سرعت متعمد لازم برای دستیابی به هم‌سازی به عنوان هدف طراحی، استقبال می‌کنیم. ما همچنین از ایده‌هایی مانند «ارزیابی‌گرهای نهفته» (embedded evaluators) در آزمایشگاه‌های هوش‌مصنوعی حمایت می‌کنیم.»

زمینه: استعفای ناگهانی در Anthropic و رویدادهای عامل‌های خارج از کنترل

این حرکت پیشگیرانه پس از یک سری رویدادهای امنیتی ناشی از رفتار غیرمنتظره عامل‌های هوش‌مصنوعی و استعفای ناگهانی یک کارمند ارشد Anthropic صورت گرفته که خطر انقراض بشر را به عنوان دلیلی برای جدایی از شرکت عنوان کرد. مایکروسافت با این قاعدة‌نامه تلاش می‌کند قبل از بروز سیستم‌های قدرتمندتر، معماری کنترل و نظارت را مستحکم کند.

متن کامل قاعدة‌نامه در وبلاگ رسمی هوش‌مصنوعی مسئول مایکروسافت در دسترس است.