ब्रिटेन के आर्टिफिशियल इंटेलिजेंस मंत्री कनिष्क नारायण ने बुधवार (5 अगस्त) को कहा कि हाल ही में AI एजेंट मूल्यांकन की घटनाओं ने यूके के AI सुरक्षा संस्थान (एआईएसआई) द्वारा साइबर सुरक्षा परीक्षण के दौरान अस्वीकृत एजेंट व्यवहार का खुलासा करने के बाद AI सुरक्षा परीक्षण के महत्व को उजागर किया है।
द इंडियन एक्सप्रेस को दिए एक बयान में नारायण ने कहा, "यूके के AI सुरक्षा संस्थान द्वारा नियमित साइबर सुरक्षा परीक्षण के दौरान, दो अग्रणी फ्रंटियर AI मॉडल ने जानबूझकर, भ्रामक कार्य किए, जो उन्हें दिए गए कार्य को पूरा करने की कोशिश में नहीं करने के लिए कहा गया था।" "कार्रवाई विफल रही। एआईएसआई ने इसे पकड़ लिया और इसे तुरंत रोक दिया। एआईएसआई द्वारा परीक्षण किए गए मॉडल के संस्करण आम जनता के लिए उपलब्ध नहीं हैं।"
मंगलवार को, संस्थान - यूके के विज्ञान, नवाचार और प्रौद्योगिकी विभाग के भीतर एक शोध संगठन जो फ्रंटियर AI मॉडल की सुरक्षा और क्षमताओं का मूल्यांकन करता है - ने कहा कि एंथ्रोपिक के प्रयोगात्मक मिथोस 5 और ओपनएआई के प्रमुख जीपीटी-5.6-सोल द्वारा संचालित AI एजेंट उनकी क्षमताओं का आकलन करने के लिए डिज़ाइन किए गए साइबर सुरक्षा मूल्यांकन के दौरान अनधिकृत कार्यों में लगे हुए थे।
सबसे गंभीर घटना में एक एजेंट शामिल था जिसने एक इंसान के रूप में नकली ऑनलाइन पहचान बनाई और एक लाइव वेबसाइट पर लिखे गए दुर्भावनापूर्ण कोड को चलाने के लिए मानवीय मंजूरी मांगी।
एआईएसआई ने एक ब्लॉग पोस्ट में कहा, "परीक्षण किए जा रहे कुछ एजेंट वास्तविक लोगों और संगठनों के लिए निरंतर, संभावित रूप से हानिकारक गतिविधि में शामिल थे।"
नारायण ने इंडियन एक्सप्रेस को बताया, ''इस तरह के नए व्यवहार की पहचान करना और अपने निष्कर्षों को साझा करना, ताकि हम इससे निपट सकें, एआईएसआई की स्थापना बिल्कुल यही करने के लिए की गई थी।'' "यह बिल्कुल महत्वपूर्ण है कि ब्रिटेन के पास AI की सुरक्षा का परीक्षण करने के लिए एक विश्व-अग्रणी संगठन हो। अगर हम AI को समझते हैं, तो हम इसे उपयोग करने के लिए सुरक्षित बना सकते हैं और यह सुनिश्चित कर सकते हैं कि लोग अपने जीवन और काम पर इससे लाभ उठा सकें।"
यह विकास इस बात की बढ़ती जांच के बीच हुआ है कि कैसे अग्रणी AI कंपनियां तैनाती से पहले तेजी से स्वायत्त AI एजेंटों का मूल्यांकन करती हैं।
पिछले महीने, OpenAI ने खुलासा किया कि उसके दो प्रायोगिक AI एजेंट, GPT-5.6-Sol द्वारा संचालित और एक अज्ञात मॉडल जिसे उसने ऑफ़लाइन ले लिया है, ने आंतरिक साइबर सुरक्षा मूल्यांकन के दौरान अपने परीक्षण वातावरण में कमजोरियों का फायदा उठाया। कंपनी के मुताबिक, एजेंटों ने AI डेवलपमेंट प्लेटफॉर्म हगिंग फेस से अनपेक्षित तरीके से बेंचमार्क उत्तर प्राप्त किए।
OpenAI ने कहा कि घटना एक नियंत्रित सैंडबॉक्स वातावरण में हुई जहां मॉडलों को सामान्य से अधिक व्यापक क्षमताएं दी गई थीं क्योंकि अभ्यास उनकी साइबर क्षमताओं का आकलन करने के लिए डिज़ाइन किया गया था।
पिछले हफ्ते, एंथ्रोपिक ने खुलासा किया कि 141,000 से अधिक साइबर सुरक्षा मूल्यांकन की समीक्षा में तीन उदाहरणों की पहचान की गई थी जिसमें इसके AI मॉडल तीसरे पक्ष के परीक्षण वातावरण से इंटरनेट तक पहुंचे और तीन वास्तविक संगठनों के सिस्टम तक अनधिकृत पहुंच प्राप्त की। कंपनी ने इन घटनाओं के लिए गलत तरीके से कॉन्फ़िगर किए गए मूल्यांकन परिवेश को जिम्मेदार ठहराया और कहा कि उसने अतिरिक्त सुरक्षा उपाय पेश करते हुए उन मूल्यांकनों को रोक दिया है।
Comments ()
Be the first to share your perspective on this story!