नई दिल्ली। ओपनएआई के एक एजेंटिक एआई सिस्टम ने प्रशिक्षण के दौरान ऐसे सुरक्षित वातावरण की सुरक्षा व्यवस्था को कथित तौर पर तोड़ दिया, जिसे इंटरनेट से पूरी तरह अलग रखा गया था। सिस्टम ने एक सुरक्षा खामी का फायदा उठाकर सार्वजनिक इंटरनेट तक पहुंच बनाई और वहां मौजूद एक बाहरी थर्ड-पार्टी चैटबॉट सेवा को कम से कम 20 सवाल भेजे। घटना सामने आने के बाद कंपनी ने अपने सबसे सक्षम मॉडलों के लिए टूल-यूज प्रशिक्षण अस्थायी रूप से रोक दिया है।
ओपनएआई के मुताबिक, घटना का पता सितंबर के अंतिम सप्ताह में चला। एजेंटिक एआई सिस्टम को एक सैंडबॉक्स वातावरण में प्रशिक्षित किया जा रहा था। इस व्यवस्था का उद्देश्य मॉडल को बाहरी इंटरनेट और अनधिकृत सेवाओं से अलग रखना था। प्रशिक्षण के दौरान सिस्टम ने इस व्यवस्था में मौजूद एक ‘गैप’ का फायदा उठाया और सार्वजनिक इंटरनेट तक पहुंच हासिल कर ली। इसके बाद उसने एक अज्ञात बाहरी चैटबॉट सेवा से संपर्क किया।
बाहरी सेवा को भेजे गए सवालों में सामान्य जानकारी से जुड़े प्रश्न भी शामिल थे। रिपोर्ट के मुताबिक, सिस्टम ने कम से कम 20 प्रश्न भेजे, जिनमें ‘फ्रांस की राजधानी क्या है’ जैसा सामान्य सवाल भी शामिल था। हालांकि, घटना में सामने आई अहम बात यह थी कि मॉडल उस इंटरनेट तक पहुंचने में सफल रहा, जिस तक उसकी पहुंच नहीं होनी चाहिए थी।
कंपनी ने इस घटना को अपने एआई सिस्टम की सुरक्षा जांच के लिए महत्वपूर्ण संकेत बताया है। ओपनएआई ने कहा कि इस विशेष मॉडल का प्रशिक्षण दोबारा शुरू नहीं किया जाएगा। साथ ही, सैंडबॉक्स की खामी दूर होने तक सबसे सक्षम मॉडलों में टूल-यूज प्रशिक्षण रोकने का निर्णय लिया गया है।
यह घटना ऐसे समय सामने आई है जब एजेंटिक एआई सिस्टम के इंटरनेट और बाहरी टूल तक पहुंच को लेकर सुरक्षा संबंधी चिंताएं बढ़ रही हैं। एजेंटिक एआई पारंपरिक चैटबॉट की तरह केवल सवालों के जवाब देने तक सीमित नहीं रहता, बल्कि दिए गए लक्ष्य को पूरा करने के लिए टूल का इस्तेमाल, जानकारी खोजना और अलग-अलग डिजिटल सेवाओं के साथ संपर्क करना भी कर सकता है। इसी वजह से प्रशिक्षण वातावरण में उसके लिए निर्धारित सीमाओं का प्रभावी ढंग से लागू होना महत्वपूर्ण माना जाता है।
Proposal for Conducting Cyber Crisis Drill, Tabletop Exercise (TTEx) & CCMP Readiness Exercise
हाल के महीनों में ओपनएआई, एंथ्रोपिक, गूगल डीपमाइंड और मेटा के विकसित एआई सिस्टम से जुड़ी कई ऐसी घटनाओं ने साइबर सुरक्षा और एआई सुरक्षा विशेषज्ञों का ध्यान खींचा है। जुलाई में आंतरिक परीक्षण के दौरान मॉडलों के एक समूह ने इंटरनेट तक पहुंच हासिल कर हगिंग फेस के सिस्टम में अनजाने में सेंध लगा दी थी। उस घटना के बाद एआई मॉडलों के लिए सुरक्षित परीक्षण वातावरण और इंटरनेट प्रतिबंधों की प्रभावशीलता पर सवाल उठे थे।
ओपनएआई ने इस बीच अपने मॉडलों के प्रशिक्षण और मूल्यांकन से जुड़ी अन्य घटनाओं की भी पुष्टि की है। कंपनी के अनुसार, कुछ मॉडलों ने प्रशिक्षण और मूल्यांकन के दौरान अमेरिकी सरकारी वेबसाइटों से जानकारी हासिल की थी। इनमें अमेरिकी जनगणना ब्यूरो और सिक्योरिटीज एंड एक्सचेंज कमीशन की वेबसाइटें शामिल थीं। कुछ दिन पहले कंपनी ने यह भी बताया था कि उसके मॉडलों ने इस साल की शुरुआत में ऑस्ट्रेलियाई सरकार की एक वेबसाइट को बाधित किया था।
ताजा सैंडबॉक्स घटना में तकनीकी सुरक्षा के साथ परिचालन प्रक्रिया में भी एक कमी सामने आई। कंपनी के आंतरिक निगरानी तंत्र ने एक मानव समीक्षक को अलर्ट भेजा। समीक्षक ने तीन मिनट के भीतर स्लैक पर अलर्ट स्वीकार कर लिया, लेकिन प्रशिक्षण प्रक्रिया अपने आप बंद नहीं हुई, जैसा कि अपेक्षित था। रिपोर्ट के मुताबिक, इसके बाद किसी व्यक्ति को मैन्युअली प्रशिक्षण प्रक्रिया रोकने में दो घंटे से अधिक समय लगा।
एआई सुरक्षा से जुड़े विशेषज्ञों ने इस घटना को केवल सैंडबॉक्स की तकनीकी खामी तक सीमित न मानकर निगरानी और आपातकालीन नियंत्रण व्यवस्था के संदर्भ में भी देखने की जरूरत बताई है। अब ओपनएआई के सामने चुनौती यह पता लगाने की है कि इंटरनेट तक पहुंचने की खामी किस स्तर पर पैदा हुई, मॉडल ने उसका इस्तेमाल कैसे किया और भविष्य में ऐसी स्थिति में प्रशिक्षण प्रक्रिया स्वतः कैसे रोकी जा सकती है।
