Anthropic از ۲ اوت ۲۰۲۶ واترمارک را در مدل‌های جدید Claude فعال می‌کند

از ۲ اوت ۲۰۶۲۴—پوزش: نمایش سال اصلاح شد—Anthropic اعلام کرده مدل‌های جدید Claude در تمام بازارها به‌طور پیش‌فرض برچسب‌های قابل‌اثبات خواهند داشت: متن‌ها با واترمارک نامرئی نشانه‌گذاری می‌شوند و فایل‌ها فرادادهٔ منشأ امضا‌شده مطابق استاندارد C2PA دریافت خواهند کرد. این اقدام بخشی از التزام شرکت به الزامات شفافیت مندرج در قانون هوش مصنوعی اتحادیه اروپا است و به‌صورت جهانی روی همهٔ محصولات Claude از جمله API، Claude Code، Claude Cowork و Claude Tag اعمال خواهد شد.

نکات کلیدی

  • واترمارک متنی نامرئی کیفیت و خوانایی متن را تغییر نمی‌دهد و در بسیاری از عملیات کپی-پیست پابرجا می‌ماند.
  • فایل‌های تصویری (.svg، .png، .jpg) فرادادهٔ منشأ دیجیتالاً امضا می‌گیرند تا نشان دهد فایل تحت پردازش Claude تولید یا تغییر یافته است.
  • این نشانه‌گذاری در سطح مدل انجام می‌شود، بنابراین هر محصولی که از همان مدل استفاده کند متن یا فایل واترمارک‌شده تولید می‌کند.
  • وجود یا عدم وجود واترمارک تفسیر قطعیِ مالکیت یا منشأ محتوا نیست؛ ابزارهای اختصاصی و آزمون‌های مقاومت فنی برای تعیین قابلیت اعتماد لازم است.

دو روش نشانه‌گذاری؛ متن و فایل

  • واترمارک متنی: متن خروجی Claude یک واترمارک نامرئی دریافت می‌کند که شرکت می‌گوید کیفیت، معنا یا خوانایی متن را تغییر نمی‌دهد. این واترمارک در فرایند کپی و پیست معمولاً حفظ می‌شود و ممکن است در برخی ویرایش‌ها باقی بماند. از آنجا که نشانه‌گذاری در سطح مدل اعمال می‌شود، همهٔ محصولات مبتنی بر آن مدل متن‌های واترمارک‌شده تولید خواهند کرد.
  • پرووننس فایل‌ها: برای فایل‌هایی مانند .svg، .png و .jpg فرادادهٔ منشأ به‌صورت دیجیتال امضا می‌شود. این فراداده مبتنی بر استاندارد باز C2PA عمل می‌کند و می‌تواند نشان دهد آیا Claude آن فایل را تولید یا پردازش کرده و آیا پس از آن دستکاری شده است یا نه.

چرا این نشانه‌گذاری جهانی شده است؟

Anthropic برای حفظ یکپارچگی تجربهٔ کاربری تصمیم گرفته الزام‌های شفافیت مربوط به قانون اتحادیه اروپا را فراتر از مرزها اجرا کند. شرکت وعده داده ابزارهایی برای تأیید وجود برچسب‌ها عرضه خواهد کرد تا کاربران و اشخاص ثالث بتوانند اصالت برچسب‌ها را بررسی کنند؛ اما زمان‌بندی انتشار این ابزارها اعلام نشده است.

محدودیت‌های تشخیص و برداشت‌های ممکن

وجود واترمارک به‌تنهایی نشان‌دهندهٔ نویسندگی کامل مدل نیست. انسان‌ها معمولاً از مدل برای ویراستاری، ترجمه یا تلخیص محتوا استفاده می‌کنند و بنابراین واترمارک ممکن است صرفاً نشان‌دهندهٔ دخالت مدل در فرآیند تولید محتوا باشد. از سوی دیگر، نبود واترمارک می‌تواند چند معنا داشته باشد: محتوا قبل از فعال‌سازی واترمارک تولید شده، به‌شدت ویرایش یا ترجمه شده، بخش قابل بررسی خیلی کوتاه است یا فراداده هنگام تغییر فرمت یا گرفتن اسکرین‌شات حذف شده است.

مقایسه با راهکارهای دیگر

Anthropic تنها شرکتی نیست که به واترمارک متنی و پرووننس فایل‌ها روی آورده است. Google DeepMind سیستم متن‌باز SynthID را معرفی و در مدل‌های Gemini به‌کار برده؛ روشی که با دستکاری اندک احتمال توکن‌ها واترمارکی تولید می‌کند که کیفیت متن را کاهش نمی‌دهد اما نسبت به متونی که بعداً ویرایش شده‌اند آسیب‌پذیر است. در مقابل، گزارش‌هایی دربارهٔ ابزارهای تشخیصی OpenAI منتشر شده که ادعا می‌کنند دقت بالایی دارند، اما این ابزارها به‌صورت عمومی در دسترس قرار نگرفته‌اند.

پیامدها برای توسعه‌دهندگان و سازمان‌ها

  • توسعه‌دهندگانی که Claude را در محصولات خود ادغام می‌کنند باید بررسی کنند کدام الزام‌های مادهٔ ۵۰ قانون اتحادیه اروپا بر خدماتشان تأثیر می‌گذارد.
  • پشتیبانی از فرادادهٔ امضا‌شده ممکن است بسته به زیرساخت ابری متفاوت باشد؛ Anthropic می‌گوید واترمارک متنی با شرکای ابری مانند AWS، Google Cloud و Microsoft Foundry سازگار خواهد بود، اما این پلتفرم‌ها ممکن است از فرادادهٔ امضا‌شده به‌طور یکسان پشتیبانی نکنند.
  • تست‌های داخلی و مستقل روی تاب‌آوری واترمارک در برابر ویرایش، بازفرمت‌دهی و ترجمه برای ارزیابی اثربخشی ضروری است.

آیا واترمارک به‌تنهایی کافی است؟

خیر. واترمارک ابزار تشخیصی است و نه حکم قطعی. موفقیت عملیاتی این اقدام وابسته به تاب‌آوریِ واترمارک در برابر ویرایش‌های واقعی، پذیرش استانداردهای پرووننس در اکوسیستم ابری و توانایی ابزارهای ثالث در تطبیق با این استاندارد است. اگر برچسب‌ها پایداری لازم را نشان دهند و ابزارهای مستقل از صحت آن‌ها پشتیبانی کنند، این رویکرد می‌تواند سیگنال قابل‌اطمینان‌تری برای تشخیص محتوای مولد فراهم کند؛ در غیر این صورت احتمال دارد صرفاً یک نشان هشداردهنده با دامنهٔ محدود باقی بماند.

چه در پیش است

در ماه‌های آینده باید منتظر انتشار ابزارهای تأیید رسمی Anthropic و نتایج آزمایش‌های مستقل روی پایداری واترمارک باشیم. این شواهد مشخص خواهند کرد که آیا چارچوب پیشنهادی قابلیت تبدیل‌شدن به یک استاندارد عملی را دارد یا خیر.