پژوهش موسسهٔ Pew Research نشان میدهد بیش از 35٪ از صفحات وبی که پس از عرضهٔ ChatGPT منتشر شدهاند، نشانههایی از نگارش یا ویرایش گسترده توسط هوش مصنوعی دارند. این یافته در کنار اعلامیهٔ Cloudflare دربارهٔ افزایش قابلتوجه ترافیک رباتها، چشمانداز جدید و چالشبرانگیزی از اکوسیستم محتوای وب ترسیم میکند. جزئیات و بحثهای مرتبط نیز در پست مرتبط سایت منتشر شده است.
روش تحقیق و اندازهٔ نمونه
Pew برای تحلیل خود از آرشیو وب Common Crawl نزدیک به نیممیلیون صفحهٔ انگلیسی را از حدود پنج سال گذشته گردآوری کرد — از پیش از عرضهٔ ChatGPT (نوامبر 2022) تا نیمهٔ 2026. با استفاده از فناوری تشخیص محتوای Pangram، صفحاتی که احتمالاً «توسط هوش مصنوعی نوشته یا بهطور قابلتوجهی ویرایش» شدهاند مشخص شدند.
در یک نمونهٔ تصادفی از 10,000 صفحه که در ژوئیهٔ 2026 بررسی شد، حدود 10٪ شاخصهای مشهود نگارش ماشینی داشتند. اما پس از حذف صفحاتِ پیش از عرضهٔ ChatGPT و تمرکز صرف بر محتوای پس از آن، نسبت صفحات دارای نشانهٔ هوش مصنوعی به بیش از 35٪ افزایش یافت.
فاصلهٔ دامنهها؛ .com در برابر .edu و .gov
تحلیل دامنهها نشان میدهد صفحات با دامنهٔ .com نرخ بسیار بالاتری از نشانههای نگارش ماشینی دارند؛ گزارش Pew میگوید این نرخ تقریباً ده برابر دامنههای .edu و .gov است (هر یک حدود 1٪). دامنههای .org هم تنها حدود 4.6٪ نرخ نشاندهندهٔ آثار هوش مصنوعی داشتند. این الگو حاکی از آن است که محتوای تجاری و مبتنی بر کسبوکار بیش از محتوای علمی یا رسمی در معرض تولید خودکار قرار گرفته است.
محدودیتها و خطاهای تشخیص
ابزارهایی مانند Pangram میتوانند خطا داشته باشند؛ برخی صفحات انسانی بهاشتباه بهعنوان تولید ماشینی شناسایی شوند و بالعکس. با این وجود، در مقیاس بزرگ افزایش شاخصهای زبانی مشخص—مثلاً استفادهٔ مکرر از خط فاصله، بهکارگیری ویرگول آکسفورد بیش از حد و بازتولید الگوهای عبارتی تکراری مانند «این X نیست، این Y است»—نشاندهندهٔ تغییر واقعی در سبک نوشتار است.
رباتها خوانندهٔ رباتها
Pew تأکید میکند که تحلیل روی محتوا متمرکز است، نه بازدیدکننده؛ بنابراین نه تنها بخش بزرگی از محتوای جدید وب احتمالاً ماشینی تولید شده، بلکه بخش عمدهای از بازدیدها نیز ممکن است توسط رباتها صورت گیرد. این چرخهٔ تولید و مصرف ماشینی پیامدهای فنی، اقتصادی و کیفیتی قابلتوجهی برای وب دارد.
پیامدها، سئو و مسیر پیشرو
- ناشران و رسانهها باید سیاستهای شفافِ برچسبگذاری برای محتوای تولیدشده با هوش مصنوعی تدوین کنند تا مخاطب بداند با چه نوع محتوایی روبهرو است.
- سرویسهای جستوجو و رتبهبندی باید معیارهایی برای تفکیک محتواهای ماشینی و انسانی در نظر بگیرند تا کیفیت نتایج و تجربهٔ کاربر حفظ شود؛ توجه به «نگارش هوش مصنوعی صفحات وب» در الگوریتمها ضروری است.
- توسعهٔ ابزارهای تشخیص دقیقتر و استانداردسازی روشهای ارزیابی میتواند خطاها را کاهش دهد؛ پژوهشهای مشترک میان دانشگاهها، صنعت و نهادهای غیرانتفاعی ضروری است.
- ملاحظات فنی مانند مدیریت ترافیک رباتها، تنظیمات خزندهها و سیاستهای نرخگذاری API باید بهروزرسانی شود تا زیرساختهای وب در برابر بار ماشینی مقاوم بماند.
پژوهش Pew یک هشدار واضح ارائه میدهد: ساختار وب در حال تغییر است و سهم قابلتوجهی از محتوای تازه احتمالاً ماشینی است. این تحول نهتنها ناشران و پلتفرمها را به چالش میکشد، بلکه مصرفکنندگان اطلاعات، سیاستگذاران و محققان را نیز ملزم به بازتعریف قواعد، ابزارها و انتظارات میکند.
برای آشنایی بیشتر با ChatGPT: ChatGPT در ویکیپدیا.





