پشت پرده تاسیس آنتروپیک و تکنیک هوش مصنوعی قانوناساسی
در صنعتی که سالهاست بر محور سرعت و تغییرات رادیکال میچرخد، آنتروپیک (Anthropic) پیشفرضی کاملاً عکس را بنیان نهاد: توسعه هوش مصنوعی پیشرفته باید در دستان کسانی باشد که نگرانترین افراد نسبت به خطرات آن هستند. این شرکت سنفرانسیسویی که در ژانویه ۲۰۲۱ توسط هفت پژوهشگر ارشد پیشین اوپنای شکل گرفت، توانست از یک استارتاپ متمرکز بر پژوهشهای امنیتی به یکی از ارزشمندترین آزمایشگاههای هوش مصنوعی جهان تبدیل شود؛ فرآیندی که در آن فلسفه همسوسازی و تکنیک انقلابی «هوش مصنوعی قانوناساسی» همیشه در کانون تمام تصمیمات فنی قرار گرفته است.
تاسیس: جدایی هوشمند از اوپنای
۲۶ ژانویه ۲۰۲۱، روزی بود که هفت توسعهدهنده و پژوهشگر کلیدی پیشین اوپنای تصمیم گرفتند مسیر خود را از هم جدا کنند. دلیلی که این تیم را به سمت ساخت یک نهاد مستقل هل داد، باور عمیق به این نکته بود که پژوهشهای حوزه ایمنی هوش مصنوعی دیگر نمیتوانند به عنوان یک پروژه حاشیهای در سازمانهایی اجرا شوند که تحت فشارهای رقابتی و تجاری شدید به سر میبرند. این تیم شامل چهرههای زیر بود:
- داریو آمودی — مدیرعامل و دکترای فیزیک، معاون سابق پژوهش در اوپنای
- دانیلا آمودی — رئیس شرکت، خواهر داریو و قبلی مسئول ایمنی و سیاستگذاری اوپنای
- جرد کاپلان — مدیر ارشد علمی و همنویسنده مقاله مرجع قوانین مقیاسپذیری
- جک کلارک
- کریس اولا
- بن مان
- سم مککندلیش
- تام براون
منطق پشت این جدایی ساده اما تعیینکننده بود. اگر سیستمهای هوش مصنوعی باید مطابق با ارزشها و قصد انسانی رفتار کنند، این فرآیند نیازمند خانهای مستقل است که اولویتگذاری آن صرفاً افزایش قابلیتها یا سودآوری نباشد. آنتروپیک این ایده را در قالب یک شرکت خدمت عمومی (PBC) نهادینه کرد. این ساختار حقوقی تضمین میکند که اهداف ایمنی و اجتماعی شرکت، در کنار منافع مالی، در دفاتر هیئتمدیره محترم شمرده شوند.
این رویکرد جسورانه بلافاصله بازتاب مالی داشت. تنها چند ماه پس از راهاندازی، در ماه مه ۲۰۲۱، آنتروپیک توانست ۱۲۴ میلیون دلار سرمایه جذب کند و در مراحل بعدی با حمایت استراتژیک غولهایی مانند گوگل و آمازون مواجه شد. آمازون به بزرگترین سرمایهگذار تکموردی این شرکت تبدیل شد و سرویس AWS جایگاه شریک ابری اصلی آنتروپیک را به خود اختصاص داد؛ الگویی که به وضوح شباهتهای ساختاری با همکاری اوپنای و مایکروسافت دارد.
شرطبندی بر ایمنی؛ وقتی سرعت کمرنگ میشود
آنتروپیک در مستندات رسمی خود به اقرار میکند که در شرایطی منحصربهفرد قرار دارد: شرکتی که خود در حال ساخت یکی از خطرناکترین و تحولآفرینترین فناوریهای تاریخ بشر است، همزمان با تمام توان در حال تلاش برای کنترل خطرات آن میباشد. بنیانگذاران این تناقض ظاهری را نه یک شکست، بلکه یک پیشبینی واقعبینانه میدانند. استدلال اصلی این است که ظهور هوش مصنوعی پیشرفته اجتنابناپذیر است؛ بنابراین بهتر است آزمایشگاههای متمرکز بر ایمنی در خط مقدم این تکنولوژی حضور داشته باشند تا اینکه توسعه این سیستمها کاملاً در دست گروههایی بماند که اولویتبندی متفاوتی دارند.
این فلسفه زمانی به یک آزمون واقعی تبدیل شد که تیم فنی در تابستان ۲۰۲۲ به پایان آموزش اولین نسخه مدل کلود دست یافت. برخلاف رونود معمول در این اکوسیستم، آنتروپیک تصمیم گرفت نسخه اولیه را منتشر نکند. دلیل این تعلل آگاهانه، نیاز به تستهای ایمنی عمیقتر و جلوگیری از ایجاد مسابقه تسلیحاتی برای توسعه مدلهای قدرتمندتر بدون زیرساخت نظارتی مناسب بود. کلود بالاخره در مارس ۲۰۲۳ وارد چرخه عمومی شد و این تأخیر در صنعتی که معمولاً سرعت را بر هر فاکتور دیگری ترجیح میدهد، پیام واضحی درباره اولویتهای این آزمایشگاه ارسال کرد.
هوش مصنوعی قانوناساسی چگونه کار میکند؟
قلب تپنده تفاوت فنی آنتروپیک با رقبا، تکنیک هوش مصنوعی قانوناساسی (Constitutional AI) است. این متدولوژی که نخستین مقالات پژوهشی آن در سال ۲۰۲۲ منتشر شد، به دنبال جایگزینی یا تکمیل روشهای سنتی نظارت انسانی است که هم پرهزینه هستند و هم مقیاسپذیری محدودی دارند.
در روش معمول یادگیری تقویتی از بازخورد انسانی (RLHF)، مدل با دریافت بازخورد مستقیم انسانها آموزش میبیند تا خروجیهایش به سمت پاسخهای مورد تایید هدایت شود. این فرآیند وابستگی شدیدی به برچسبگذاری دستی و هزینههای عملیاتی بالا ایجاد میکند. رویکرد آنتروپیک مسیری مصنوعیتر و کنترلشدهتر را در پیش گرفته است.
در اینجا، به جای تکیه صرف بر ناظران انسانی، یک مجموعه قوانین نوشتاری به نام «قانون اساسی» مدل تحمیل میشود. این اسناد که اصولی مانند احترام به حریم خصوصی، پرهیز از تولید محتوای مخرب، و شفافیت در استدلال را پوشش میدهند، به عنوان مرجع نهایی عمل میکنند. مدل خود به صورت دورهای خروجیهای تولیدشده را در مقابل این اصول میسنجد، خطاهای احتمالی را شناسایی میکند و نسخه اصلاحشده خود را میسازد. این چرخه خودترمیمی باعث میشود مدل بدون نیاز به تکرار مداوم فرآیندهای انسانی، به استانداردهای ایمنی و همسوسازی بالاتری دست یابد.
چرا این معماری آینده توسعه را تعیین میکند؟
مزیت اصلی Constitutional AI در مقیاسپذیری و کاهش خطاهای ناشی از سوگیری انسانی نهفته است. وقتی مدل بتواند خود به صورت مستمر در مقابل مجموعهای از اصول اخلاقی و فنی ارزیابی شود، فرآیند آموزش سریعتر، کمهزینهتر و قابل پیگیریتر خواهد بود. این تکنیک همچنین به مدلها کمک میکند تا در موقعیتهای ابهامآمیز یا جدید، به جای تقلید کورکورانه از دادههای آموزشی، بر اساس چارچوب تعیینشده استدلال کنند.
با ورود مدلهای بزرگ زبانی به مرحله عملیاتی در مقیاس سازمانی، نیاز به مکانیسمهای نظارتی خودکار بیش از پیش احساس میشود. آنتروپیک با تثبیت Constitutional AI، نشان میدهد که مسابقه توسعه هوش مصنوعی دیگر تنها یک رقابت بر سر تعداد پارامترها یا سرعت پردازش نیست. نسل آینده سیستمهای هوشمند باید بتوانند در عین افزایش قدرت، رفتارهای قابل پیشبینی، قابل کنترل و متناظر با ارزشهای انسانی از خود نشان دهند. راهی که در ۳ سال گذشته شکل گرفته است، احتمالاً الگوی استاندارد برای تمام پروژههای حساس و کلیدی در سالهای پیشرو خواهد شد و تعریف دقیقتری از تعادل میان نوآوری و مسئولیتپذیری ارائه میکند.





