Pew Research की गुरुवार को जारी एक नई स्टडी के मुताबिक, ChatGPT लॉन्च होने के बाद से प्रकाशित एक तिहाई से ज्यादा वेबपेजों पर AI के लिखे होने के संकेत मिलते हैं। रिपोर्ट में उन दूसरी स्टडीज़ का भी समर्थन किया गया है जो बताती हैं कि वेब के नए पेजों में से कितने अब या तो AI द्वारा लिखे जाते हैं या फिर 'काफी हद तक AI द्वारा एडिट' किए जाते हैं।
यह रिपोर्ट ऐसे समय में आई है जब इंटरनेट इंफ्रास्ट्रक्चर प्रोवाइडर Cloudflare ने बताया कि बॉट ट्रैफिक ने इंसानी ट्रैफिक को पीछे छोड़ दिया है — यह मुकाम उसके अनुमान से पहले ही हासिल हो गया।
हालांकि, Pew का डेटा इस बात पर फोकस्ड नहीं है कि वेब पर कौन या क्या ब्राउज़ कर रहा है, बल्कि इस पर है कि क्या ब्राउज़ किया जा रहा है। और जाहिर है, इसमें से बहुत कुछ बॉट्स द्वारा लिखे गए वेबपेजों को पढ़ने वाले बॉट्स हैं।
रिपोर्ट तैयार करने के लिए, Pew ने बताया कि उसने Common Crawl वेब आर्काइव का इस्तेमाल करके पिछले पांच सालों में प्रकाशित लगभग पांच लाख अंग्रेजी वेबपेजों को इकट्ठा किया, जो ChatGPT के नवंबर 2022 में लॉन्च होने से कुछ साल पहले से शुरू होते हैं। Pew ने फिर Open Pangram की तकनीक का इस्तेमाल करके यह पता लगाया कि कितने पेज संभवतः AI द्वारा लिखे या भारी मात्रा में एडिट किए गए हैं।
जुलाई 2026 में एकत्र किए गए 10,000 वेबपेजों के रैंडम सैंपल में, लगभग 10% में 'AI लेखकत्व के महत्वपूर्ण संकेत' मिले, Pew ने कहा।
हालांकि, Pew ने बताया कि इस तरह के रैंडम सैंपल में पुराने वेबपेज भी शामिल होते हैं — जो AI राइटिंग टूल्स के अस्तित्व में आने से पहले प्रकाशित हुए थे, और इसलिए वे AI द्वारा लिखे नहीं जा सकते थे।
यह जानने के लिए कि वेब पर कितनी सामग्री अब AI द्वारा लिखी जा रही है, Pew ने पुराने वेबपेजों को हटा दिया और केवल ChatGPT लॉन्च के बाद प्रकाशित पेजों पर ध्यान केंद्रित किया।
इस स्नैपशॉट में, जब पुराने पेजों को हटा दिया गया, तो एक तिहाई से अधिक (35%) पेजों में AI लेखकत्व के संकेत मिले।
डोमेन के स्तर पर, Pew ने पाया कि .com डोमेन वाले URLs में .edu या .gov डोमेन की तुलना में लगभग 10 गुना अधिक AI लेखकत्व के संकेत मिले (दोनों में लगभग 1% AI-लेखकत्व था)। इसके अलावा, .org डोमेन में केवल 4.6% AI लेखकत्व की दर थी।
बेशक, यह विश्लेषण पूरी तरह सटीक नहीं है। Pangram, अन्य AI डिटेक्शन टूल्स की तरह, कुछ पेजों को गलत तरीके से AI-लिखित के रूप में वर्गीकृत कर सकता है, जबकि वे AI द्वारा नहीं लिखे गए हों। लेकिन बड़े पैमाने पर, डेटा कम से कम दिशा में सही होने की संभावना है।
इसके अलावा, Pew ने पाया कि AI लेखकत्व के अन्य कथित संकेत भी वर्षों में बढ़े हैं, जैसे एम डैश का उपयोग, ऑक्सफोर्ड कॉमा, और 'यह X नहीं है, यह Y है' जैसे वाक्यांश, आदि।
Comments ()
Be the first to share your perspective on this story!