سازمان امنیت ملی آمریکا (NSA)، آژانس امنیت سایبری و زیرساخت‌ها (CISA) و Büro تحقيقات فدرال (FBI) در یک مشاوره امنیتی مشترک، فعالیت گسترده شرکت‌های هوش مصنوعی مستقر در چین را برای «استخراج سیستماتیک» قابلیت‌های اختصاصی مدل‌های پیشرو آمریکایی افشا کردند. این سه آژانس،Campaign تقطیر (Distillation) در مقیاس صنعتی را «هسته» اصلی استراتژی توسعه هوش مصنوعی پکن توصیف نموده‌اند.

تقطیر: از تکنیک علمی به ابزار رقیق‌سازی تجاری

تقطیر در ادبیات هوش مصنوعی روشی استاندارد برای انتقال دانش از یک مدل بزرگ (معلم) به مدل کوچکتر و کارآمدتر (شاگرد) است. با این حال، مشاوره مشترک تأکید می‌کند که اکوسیستم هوش مصنوعی چین این تکنیک را به «حمله‌ای تهاجمی، مخرب و هدفمند» متحول ساخته تا کارکردهای محدود و اختصاصی مدل‌هایی چون Anthropic Claude، OpenAI GPT، Google Gemini و xAI Grok را استخراج نماید.

بر اساس بیانیه رسمی، از اواسط اواخر ۲۰۲۴ تاکنون میلیاردها توکن در میلیون‌ها تبادل تعاملی از این مدل‌ها خارج شده است؛ امری که طبق ارزیابی آژانس‌ها، با رضایت ضمنی یا صریح دولت چین صورت گرفته است.

شش игрок اصلی در کانون اتهامات

مشاوره به صراحت شش شرکت چینی را نام برده و جزئیات کمپین‌های تقطیر هر یک را تشریح نموده است:

  • DeepSeek: اجرای کمپین‌های سازمان‌یافته بین اواخر ۲۰۲۴ و میانه ۲۰۲۵ با تمرکز بر استدلال، بهینه‌سازی‌های تخصصی و توابع حوزه‌های خاص برای آموزش مدل‌های R1 و V3.
  • Moonshot AI: استخراج داده‌های Claude Fable 5 جهت مدل Kimi-K3 و GPT-4o جهت Kimi-K2.
  • Alibaba: تقطیر از Claude-4، Claude Opus، Claude Sonnet و GPT-5 در اواخر ۲۰۲۵ برای ارتقای مهندسی نرم‌افزار، دیالوگ خدمات مشتری، تولید تصویر/شخصیت و یکپارچه‌سازی یادگیری تقویتی (RL)، تنظیم تحت نظارت (SFT) و تقطیر.
  • MiniMax: استخراج زنجیره تفکر (CoT)، RL، SFT و قابلیت‌های مهندسی نرم‌افزار از Claude Code، Claude Sonnet 4، Claude Opus، Gemini 1، 2.5 Pro و 3 Pro جهت توسعه مدل M2.
  • StepFun: تقطیر از Claude Opus 4.1/4.5، Sonnet 4.5، Haiku 4.5، GPT-5 Mini/Pro/5.1/5.1 Codex/5.2 در بازه اواخر ۲۰۲۵ تا اوایل ۲۰۲۶ برای تقویت کدنویسی و توابع عاملان (Agentic) در مدل Step 4.
  • Z.AI: استخراج میلیاردها توکن از GPT-5.5 و Claude Opus 4.8 تا میانه ۲۰۲۵ جهت توسعه استدلال زنجیره فکر.

مکانیزم اجرا: بستر خاکستری پروکسی و اشتراک‌های جمعی

از آنجا که مدل‌های پیشرو آمریکا به طور رسمی در چین در دسترس نیستند، توسعه‌دهندگان چینی از یک زیرساخت پیچیده برای دور زدن محدودیت‌ها بهره می‌برند:

  • خرید انبوه اشتراک‌های پرمیوم که در میان تیم‌های توسعه به اشتراک گذاشته می‌شوند.
  • استفاده از VPN، حساب‌های مبهم‌سازی‌شده و عامل‌های خودکار (Automated Agents) برای مقابله با کنترل‌های جغرافیایی (Geo-blocking).
  • استفاده از بازار خاکستری پروکسی‌ها در پلتفرم‌هایی نظیر Taobao و Xianyu که به عنوان ایستگاه‌های واسط (Proxy Stations) عمل می‌کنند.
  • توزیع ترافیک در میان چندین ارائه‌دهنده و پلتفرم برای ماندن در زیر رادار سیستم‌های تشخیص ناهنجاری.

تاکتیک‌های پیشرفته: فراتر از تقطیر سنتی

آژانس‌های امنیتی سه سطح از پیشرفته‌سازی در روش‌های حمله را شناسایی کرده‌اند:

  1. استخراج استدلال زنجیره فکر (CoT): هدف‌گیری نه تنها بر روی خروجی نهایی، بلکه بر روی فرآیند استدلال پنهان و بین‌مرحله‌ای مدل معلم.
  2. تغییر مسیر خودکار (Automated Failover): جابجایی لحظه‌ای بین مسیرهای دسترسی مختلف در هنگام مسدود شدن یا تشخیص فعالیت مشکوک.
  3. چارچوب‌های ارزیابی کیفیت: پیاده‌سازی سیستم‌های هوشمند برای تشخیص و دور زدن تدابیر دفاعی поставندگان مدل.

نتیجه مستقیم این رویکرد، کوتاه شدن شدید خط زمان توسعه و کاهش چشمگیر هزینه‌های آموزش مدل‌های پیشرو در طرف چینی است.

پاسخگویی پیشنهادی: استراتژی دفاع در عمق

آژانس‌ها از شرکت‌های توسعه‌دهنده هوش مصنوعی در آمریکا خواستار اقدامات زیر شده‌اند:

  • پیاده‌سازی جامع تدابیر تشخیص و کاهش ریسک (Detection & Mitigation) در سطح زیرساخت.
  • اعمال تغییرات ظریف و استراتژیک در پاسخ‌ها (Obfuscation/Poisoning) برای ناتالifiant کردن تلاش‌های مشکوک تقطیر مخرب.
  • برقراری همبستگی عملیاتی (Operational Correlation) در سراسر ارائه‌دهندگان مدل، پلتفرم‌های ابری و تجمع‌کنندگان API جهت آشکارسازی کمپین‌های توزیع‌شده و هماهنگ.

این اولین موارد نیست؛ در فوریه امسال Anthropic نیز کمپین‌های مقیاس صنعتی DeepSeek و Moonshot AI را فاش کرده بود. با این حال، مشاوره جاری گسترده‌ترین و رسمی‌ترین اتهام‌گذاری سطح دولت آمریکا در این حوزه محسوب می‌شود.

نمایه‌گذاری حملات تقطیر هوش مصنوعی توسط آژانس‌های امنیتی آمریکا
نمایه‌گذاری حملات تقطیر هوش مصنوعی توسط آژانس‌های امنیتی آمریکا

جنگ نمادین بر سر مالکیت فکری در عصر هوش مصنوعی وارد فاز جدیدی شده است: مبحث دیگر دزدیدن کد منبع نیست، بلکه استخراج و تقطیر «ذهن» و استدلال مدل‌هاست.