हाल ही में, जब मैं अपने फोन पर स्क्रॉल कर रहा था, मुझे एहसास हुआ कि मैं एक नई तरह की थकान से पीड़ित था: सुस्ती से प्रेरित बर्नआउट। सोशल मीडिया पर मैं जो भी पोस्ट पढ़ रहा था उनमें लगभग सभी पोस्ट बुलेट पॉइंट, इमोजी और एम डैश से भरे हुए थे। वे स्पष्ट रूप से एक चैटबॉट के काम की तरह लग रहे थे।
इस महीने, मेरे संदेह की पुष्टि एक वेब टूल द्वारा की गई जो चर्चा में है: पंग्राम, जो यह पता लगाने के लिए कृत्रिम बुद्धिमत्ता का उपयोग करता है कि चैटबॉट्स के साथ शब्द कब उत्पन्न हुए थे। उपयोगकर्ता पैनग्राम को स्कैन करने के लिए बस टेक्स्ट के एक ब्लॉक में पेस्ट कर सकते हैं, और टूल एक प्रतिशत की गणना करता है जो दर्शाता है कि कितना टेक्स्ट बॉट द्वारा तैयार किया गया था या किसी व्यक्ति द्वारा लिखा गया था।
मैंने पैंग्राम का परीक्षण किया, जिसकी लागत $20 प्रति माह है, लगभग एक सप्ताह तक और सिस्टम को चुनौती देने के लिए सभी प्रकार के प्रयोग किए। मैंने इसे मेरे लेखन की नकल करने के निर्देश दिए गए चैटबॉट्स से उत्पन्न पाठ के साथ-साथ व्यक्तिगत निबंध भी खिलाए। मैंने लिंक्डइन और रेडिट से सोशल मीडिया पोस्ट भी अपलोड किए, जिनके बारे में मुझे संदेह था कि वे AI-जनरेटेड थे। दर्जनों परीक्षणों में, डिटेक्टर मानव लेखन से ढलान को अलग करने में कभी विफल नहीं हुआ।
हालांकि पैंग्राम उन कई AI डिटेक्टरों में से एक है जो हाल के वर्षों में बाजार में आए हैं, यह उत्पाद अपनी सटीकता के कारण अलग दिखता है। पंग्राम का कहना है कि इसकी तकनीक 10,000 में से 9,999 बार सटीक रूप से पहचान सकती है कि टेक्स्ट AI-जनरेटेड था या नहीं; शिकागो विश्वविद्यालय के एक स्वतंत्र अध्ययन में यह भी पाया गया कि यह उपकरण पाठ के साथ लगभग बिल्कुल सही था। इसके विपरीत, पिछले AI टेक्स्ट स्कैनर्स ने गंभीर त्रुटियां कीं, जिनमें चार्ल्स डिकेंस जैसे प्रसिद्ध लेखकों के लेखन की गलत पहचान भी शामिल थी।
जिस दर से वेब पर गंदगी फैल रही है - कुछ अध्ययनों का कहना है कि 50% ऑनलाइन लेख अब कृत्रिम रूप से उत्पन्न होते हैं - AI डिटेक्टर एंटीवायरस सॉफ़्टवेयर के समान अगला मुख्य ऐप बन सकता है, जिसकी लोगों को ऑनलाइन नकली, कम गुणवत्ता वाली जानकारी से खुद को बचाने की आवश्यकता होगी।
हालाँकि, AI सामग्री को स्कैन करने की तकनीक को अभी भी एक लंबा रास्ता तय करना बाकी है। अन्य AI डिटेक्टरों की तरह, पंग्राम अपने दूसरे काम में बहुत अच्छा नहीं है: AI-जनरेटेड छवियों की पहचान करना, जो ऑनलाइन गलत सूचना फैलाने के लिए एक अधिक शक्तिशाली माध्यम है। (इस पर बाद में और अधिक जानकारी।)
यहां वह है जो आपको जानना आवश्यक है।
जिस तरह AI चैटबॉट लेखन और इमेजरी को दोहराने के लिए हमारी रचनाओं में पैटर्न का विश्लेषण करने में उत्कृष्टता प्राप्त करते हैं, उसी तरह पैंग्राम जैसे डिटेक्टर AI-जनरेटेड लेखन और चित्रों की विशेषताओं को समझने के लिए AI मॉडल से एकत्र किए गए डेटा का विश्लेषण करते हैं।
AI लेखन का पता लगाने के लिए, कार्यप्रणाली ईएम डैश और बुलेट पॉइंट की तलाश करने जितनी सरल नहीं है। पंग्राम के संस्थापक मैक्स स्पेरो ने कहा, प्रत्येक AI चैटबॉट, जैसे क्लाउड, चैटजीपीटी और जेमिनी, एक "निर्णय वृक्ष" का अनुसरण करते हैं, जहां चुना गया प्रत्येक शब्द एक निर्णय होता है जो दूसरे निर्णय की ओर ले जाता है। उन्होंने कहा, AI लेखन की सटीक पहचान यह समझने में निहित है कि प्रत्येक AI मॉडल का निर्णय वृक्ष कैसे काम करता है, जिसमें प्रत्येक मॉडल पर भारी मात्रा में डेटा इकट्ठा करना शामिल है।
स्पेरो ने कहा, "हम उनकी शैलीगत फिंगरप्रिंट को रिवर्स इंजीनियरिंग कर रहे हैं।"
AI-जनरेटेड छवियों के साथ, स्पष्ट संकेत होते हैं, जैसे पिक्सेल के अंदर की बनावट जो खुरदरी दिखती है जबकि उन्हें चिकना होना चाहिए, अत्यधिक संतृप्त रंग या प्रकाश में असंगतता।
ओपनएआई, एंथ्रोपिक और गूगल समेत AI चित्र जनरेटर के पीछे की कुछ कंपनियां छवि के मेटाडेटा में अदृश्य उंगलियों के निशान, जिन्हें वॉटरमार्क के रूप में जाना जाता है, को भी एम्बेड करती हैं, ताकि डिटेक्टरों को पता चल सके कि AI के साथ कुछ उत्पन्न हुआ है।
AI-निर्मित लेखन में वॉटरमार्क भी जल्द ही आ रहे हैं। एंथ्रोपिक ने इस सप्ताह घोषणा की कि उसने लोगों को इसके AI-जनरेटेड टेक्स्ट का पता लगाने में मदद करने के लिए अपने क्लाउड चैटबॉट द्वारा निर्मित लेखन में एक अदृश्य वॉटरमार्क एम्बेड करने की योजना बनाई है। यह कदम AI सामग्री की पारदर्शिता की आवश्यकता वाले यूरोपीय संघ के नियमों की प्रतिक्रिया थी; उम्मीद है कि अन्य AI कंपनियां भी इसका अनुसरण करेंगी।
मैंने पंग्राम के वर्ड डिटेक्टर पर लगभग 50 परीक्षण चलाए। मैंने अपने व्यक्तिगत लेखन के अंशों को बीच में कुछ AI-जनित वाक्यों के साथ चिपकाने का प्रयास किया। पंग्राम ने सही ढंग से पता लगाया कि गद्य ज्यादातर मानव निर्मित था और एक चैटबॉट द्वारा निर्मित कुछ वाक्यों पर प्रकाश डाला गया।
मैंने इसके विपरीत भी प्रयास किया: अपने कुछ लेखन को AI ढलान के अनुच्छेदों के भीतर छिड़क दिया। फिर, पंग्राम ने मेरे लेखन को सही ढंग से मानवीय बताया और कहा कि इसका बाकी हिस्सा AI था।
मैंने डिकेंस के सार्वजनिक रूप से उपलब्ध अंशों को अपलोड करने का प्रयास किया। पंग्राम ने निष्कर्ष निकाला कि वे 100% मानव-लिखित थे।
मैंने मुट्ठी भर लिंक्डइन पोस्ट को स्कैन किया जो किसी मशीन द्वारा लिखी गई प्रतीत होती थीं। पंग्राम ने खुलासा किया कि एक तकनीकी कर्मचारी ने अपने पोस्ट का परिचयात्मक वाक्य लिखा था लेकिन बाकी को उत्पन्न करने के लिए AI का इस्तेमाल किया। (मैंने कर्मचारी को संदेश भेजा, जिसने संकोचपूर्वक इसकी पुष्टि की।) यह अनुभव सशक्त लगा - एक पल के लिए मुझे फिल्म "वे लिव" में नाडा जैसा महसूस हुआ, जब उसने एलियंस का पता लगाने के लिए धूप का चश्मा लगाया था।
मैंने AI फोटो डिटेक्शन के परीक्षण के लिए एक अलग तरीका अपनाया: मैंने 20 AI-जनरेटेड छवियां अपलोड कीं जिन्हें व्यापक रूप से ऑनलाइन साझा किया गया था और समाचार आउटलेट्स द्वारा पंग्राम और हाइव डिटेक्ट में डिबंक किया गया था, जो एक समान AI इमेज डिटेक्टर है। मेरा नमूना आकार छोटा था, लेकिन पंग्राम और हाइव डिटेक्ट इतनी जल्दी विफल हो गए कि मुझे जारी रखने का कोई मतलब नहीं दिखा। (मेरे सहयोगी स्टुअर्ट थॉम्पसन ने इस वर्ष AI छवि स्कैनर का अधिक व्यापक परीक्षण किया।)
हाइव डिटेक्ट ने AI-जनरेटेड आठ छवियों को गलत तरीके से वास्तविक के रूप में पहचाना, जिसमें एक हालिया डीपफेक भी शामिल है, जिसमें अभिनेत्री ज़ेंडया गर्भवती दिखाई देती हैं, अस्पताल के बिस्तर पर सेन मिच मैककोनेल की एक तस्वीर और सैन फ्रांसिस्को में सड़क के संकेत को दर्शाने वाली एक तस्वीर जो बताती है कि दुकानों से 950 डॉलर से कम कीमत का सामान चुराना ठीक है।
पंग्राम ने दो AI छवियों की गलत पहचान की, जिनमें एक मैककोनेल की और सैन फ्रांसिस्को में नकली संकेत शामिल है। लेकिन टूल ने उन चार छवियों को स्कैन करने से भी इनकार कर दिया जो हिंसक लग रही थीं या अनुमान लगाने के लिए बहुत कम गुणवत्ता वाली थीं।
दोनों डिटेक्टरों ने कुछ प्रसिद्ध नकली चीज़ों को सही ढंग से चिह्नित किया, जिनमें ज़ेंडया और उनके "स्पाइडर-मैन" सह-कलाकार टॉम हॉलैंड की शादी को चित्रित करने वाली एक तस्वीर, राष्ट्रपति डोनाल्ड ट्रम्प की चीन यात्रा के दौरान एक लड़की को पकड़े हुए एक तस्वीर और जेफरी एप्सटीन के साथ पार्टी करते हुए क्लिंटन की एक तस्वीर शामिल है।
हाइव ने कहा कि मेरे कुछ परीक्षणों में, जैसे कि मैककोनेल की तस्वीर, मैंने सोशल मीडिया पर साझा की गई छवि की एक प्रति को स्कैन किया होगा जिसमें मूल के विवरण की कमी है, जिससे गलत परिणाम हो सकता है। इस तर्क के साथ मेरी चिंता यह है कि जब तक ज्यादातर लोग AI स्लोप को ऑनलाइन देखते हैं, तब तक छवि या तो मूल का स्क्रीनशॉट होती है या सोशल मीडिया प्लेटफॉर्म द्वारा स्वचालित रूप से छोटा कर दी जाती है। यदि AI डिटेक्टरों को विफल करने के लिए बस इतना ही करना पड़ता है, तो तकनीक बहुत अनुपयोगी है।
पंग्राम के स्पेरो ने कहा कि वह आश्चर्यचकित थे कि उनका टूल मैककोनेल की छवि को चिह्नित करने में विफल रहा, लेकिन उन्होंने कहा कि AI इमेज डिटेक्शन उत्पाद के लिए एक नई, अधूरी सुविधा थी। उन्होंने कहा, उनकी कंपनी के 43 AI छवियों के परीक्षण में, पैंग्राम ने 41 की सही पहचान की।
AI इमेजरी को पहचानने में पंग्राम की समस्याओं के बावजूद, बॉट-निर्मित शब्दों का पता लगाने में इसकी दक्षता इसे AI-लिखित ईमेल घोटाले, नकली ऑनलाइन समीक्षा और अरुचिकर लिंक्डइन पोस्ट जैसी परेशानियों को दूर करने के लिए बहुत उपयोगी बना देगी।
AI-निर्मित तस्वीरें, जो तेजी से ऑनलाइन फैलती हैं, एक बड़ी समस्या बनी हुई हैं। डार्टमाउथ प्रोफेसर और डिजिटल सामग्री की प्रामाणिकता की पुष्टि करने वाली कंपनी गेटरियल सिक्योरिटी के संस्थापक हनी फरीद ने कहा कि उन्होंने पंग्राम के छवि स्कैनर के साथ अपना त्वरित प्रयोग चलाया था। उन्होंने पांच AI-जनरेटेड युद्धकालीन तस्वीरें अपलोड कीं, और पैंग्राम ने तीन को चिह्नित किया।
फरीद ने कहा कि नकली और असली तस्वीरों में अंतर करना बेहद कठिन है क्योंकि एक छवि को कई अलग-अलग तरीकों से विकृत और हेरफेर किया जा सकता है। उनके शोध में, विज़ुअल AI डिटेक्टर आम तौर पर अभी भी बहुत त्रुटिपूर्ण थे।
फिलहाल, उन्होंने सुझाव दिया कि लोग वास्तविक जानकारी के लिए विश्वसनीय मीडिया आउटलेट्स पर भरोसा करें।
फरीद ने कहा, ''सोशल मीडिया से अपनी खबरें लेना बंद करें।'' "यह धारणा कि आप जो देख रहे हैं उनमें से अधिकांश नकली है, शायद अभी काफी अच्छी है।"
Comments ()
Be the first to share your perspective on this story!