پژوهش موسسهٔ Pew Research نشان می‌دهد بیش از 35٪ از صفحات وبی که پس از عرضهٔ ChatGPT منتشر شده‌اند، نشانه‌هایی از نگارش یا ویرایش گسترده توسط هوش مصنوعی دارند. این یافته در کنار اعلامیهٔ Cloudflare دربارهٔ افزایش قابل‌توجه ترافیک ربات‌ها، چشم‌انداز جدید و چالش‌برانگیزی از اکوسیستم محتوای وب ترسیم می‌کند. جزئیات و بحث‌های مرتبط نیز در پست مرتبط سایت منتشر شده است.

روش تحقیق و اندازهٔ نمونه

Pew برای تحلیل خود از آرشیو وب Common Crawl نزدیک به نیم‌میلیون صفحهٔ انگلیسی را از حدود پنج سال گذشته گردآوری کرد — از پیش از عرضهٔ ChatGPT (نوامبر 2022) تا نیمهٔ 2026. با استفاده از فناوری تشخیص محتوای Pangram، صفحاتی که احتمالاً «توسط هوش مصنوعی نوشته یا به‌طور قابل‌توجهی ویرایش» شده‌اند مشخص شدند.

در یک نمونهٔ تصادفی از 10,000 صفحه که در ژوئیهٔ 2026 بررسی شد، حدود 10٪ شاخص‌های مشهود نگارش ماشینی داشتند. اما پس از حذف صفحاتِ پیش از عرضهٔ ChatGPT و تمرکز صرف بر محتوای پس از آن، نسبت صفحات دارای نشانهٔ هوش مصنوعی به بیش از 35٪ افزایش یافت.

فاصلهٔ دامنه‌ها؛ .com در برابر .edu و .gov

تحلیل دامنه‌ها نشان می‌دهد صفحات با دامنهٔ .com نرخ بسیار بالاتری از نشانه‌های نگارش ماشینی دارند؛ گزارش Pew می‌گوید این نرخ تقریباً ده برابر دامنه‌های .edu و .gov است (هر یک حدود 1٪). دامنه‌های .org هم تنها حدود 4.6٪ نرخ نشان‌دهندهٔ آثار هوش مصنوعی داشتند. این الگو حاکی از آن است که محتوای تجاری و مبتنی بر کسب‌وکار بیش از محتوای علمی یا رسمی در معرض تولید خودکار قرار گرفته است.

محدودیت‌ها و خطاهای تشخیص

ابزارهایی مانند Pangram می‌توانند خطا داشته باشند؛ برخی صفحات انسانی به‌اشتباه به‌عنوان تولید ماشینی شناسایی شوند و بالعکس. با این وجود، در مقیاس بزرگ افزایش شاخص‌های زبانی مشخص—مثلاً استفادهٔ مکرر از خط فاصله، به‌کارگیری ویرگول آکسفورد بیش از حد و بازتولید الگوهای عبارتی تکراری مانند «این X نیست، این Y است»—نشان‌دهندهٔ تغییر واقعی در سبک نوشتار است.

ربات‌ها خوانندهٔ ربات‌ها

Pew تأکید می‌کند که تحلیل روی محتوا متمرکز است، نه بازدیدکننده؛ بنابراین نه تنها بخش بزرگی از محتوای جدید وب احتمالاً ماشینی تولید شده، بلکه بخش عمده‌ای از بازدیدها نیز ممکن است توسط ربات‌ها صورت گیرد. این چرخهٔ تولید و مصرف ماشینی پیامدهای فنی، اقتصادی و کیفیتی قابل‌توجهی برای وب دارد.

پیامدها، سئو و مسیر پیش‌رو

  • ناشران و رسانه‌ها باید سیاست‌های شفافِ برچسب‌گذاری برای محتوای تولیدشده با هوش مصنوعی تدوین کنند تا مخاطب بداند با چه نوع محتوایی روبه‌رو است.
  • سرویس‌های جست‌وجو و رتبه‌بندی باید معیارهایی برای تفکیک محتواهای ماشینی و انسانی در نظر بگیرند تا کیفیت نتایج و تجربهٔ کاربر حفظ شود؛ توجه به «نگارش هوش مصنوعی صفحات وب» در الگوریتم‌ها ضروری است.
  • توسعهٔ ابزارهای تشخیص دقیق‌تر و استانداردسازی روش‌های ارزیابی می‌تواند خطاها را کاهش دهد؛ پژوهش‌های مشترک میان دانشگاه‌ها، صنعت و نهادهای غیرانتفاعی ضروری است.
  • ملاحظات فنی مانند مدیریت ترافیک ربات‌ها، تنظیمات خزنده‌ها و سیاست‌های نرخ‌گذاری API باید به‌روزرسانی شود تا زیرساخت‌های وب در برابر بار ماشینی مقاوم بماند.

پژوهش Pew یک هشدار واضح ارائه می‌دهد: ساختار وب در حال تغییر است و سهم قابل‌توجهی از محتوای تازه احتمالاً ماشینی است. این تحول نه‌تنها ناشران و پلتفرم‌ها را به چالش می‌کشد، بلکه مصرف‌کنندگان اطلاعات، سیاست‌گذاران و محققان را نیز ملزم به بازتعریف قواعد، ابزارها و انتظارات می‌کند.

برای آشنایی بیشتر با ChatGPT: ChatGPT در ویکی‌پدیا.