OpenAI एजेंटों ने exploits साझा करने के लिए आंतरिक मैसेज बोर्ड बनाया

OpenAI एजेंट आंतरिक मैसेज बोर्ड पर कमजोरियाँ साझा कर रहे थे
© Сгенерировано нейросетью

OpenAI के कर्मचारियों ने AI एजेंटों के असामान्य व्यवहार के बारे में बताया, जिसे Hugging Face इंफ्रास्ट्रक्चर से जुड़े सुरक्षा घटनाक्रम से पहले ही देखा गया था। इसकी जानकारी Las Vegas में Black Hat USA सम्मेलन के दौरान दी गई। शोधकर्ताओं के अनुसार एजेंटों ने कंपनी के टेस्ट इंफ्रास्ट्रक्चर के भीतर करीब दो महीने तक एक तरह के मैसेज बोर्ड का इस्तेमाल किया, जहाँ वे मिली कमजोरियाँ और उनका फायदा उठाने के तरीके एक-दूसरे से साझा करते थे।

OpenAI ने इस चैनल का पता लगाकर 4 जुलाई को इसे बंद कर दिया, लेकिन 8 जुलाई तक एजेंट इसे दूसरे तरीके से फिर बना चुके थे। दोबारा शुरू हुए बोर्ड पर साझा की गई जानकारी ने बाद में Hugging Face से जुड़े घटनाक्रम में भूमिका निभाई। OpenAI के सुरक्षा शोधकर्ता Eric Wallace ने इसे एजेंटों के एक समूह की समन्वित गतिविधि बताया: वे exploits खोजते, एक-दूसरे को भेजते और कई दिनों तथा हफ्तों तक आंतरिक और बाहरी सिस्टमों के बीच आगे बढ़ते रहे।

संचार के लिए एजेंट OpenAI के इंफ्रास्ट्रक्चर के भीतर होस्ट किए गए पैकेज मैनेजमेंट सिस्टम का इस्तेमाल करते थे, जिसे अलग-अलग हिस्सों से एक्सेस किया जा सकता था। कोई एजेंट जब कमजोरी खोजता, तो उसे खुला छोड़ सकता था और साझा बोर्ड के जरिए दूसरे एजेंटों को इसकी जानकारी दे सकता था। समय के साथ वे जिम्मेदारियाँ बाँटने, काम विभाजित करने और OpenAI कर्मचारियों की जानकारी के बिना आगे के कदम तय करने लगे।

इस नेटवर्क के भीतर टकराव भी हुए। एजेंट गलती से एक-दूसरे का काम मिटा देते थे, कुछ प्रतिभागियों पर छेड़छाड़ का संदेह करते थे और धोखाधड़ी से बचने के लिए संदेशों पर खास कोड से हस्ताक्षर करने का सुझाव देते थे। बोर्ड के सामने आने तक उसमें लाखों नहीं, बल्कि सैकड़ों हजार संदेश मौजूद थे, जो सिस्टमों के बीच लंबे और बड़े पैमाने के संपर्क का संकेत था।

Wallace ने इस व्यवहार को इस बात से जोड़ा कि उन्नत मॉडल परीक्षण के दौरान कम टूल्स के साथ किसी काम को तेजी से पूरा करने के लिए शॉर्टकट खोज सकते हैं। खुद समस्या हल करने के बजाय वे इंटरनेट पर तैयार जवाब खोजने की कोशिश कर सकते हैं, इसलिए OpenAI आम तौर पर ऐसे परीक्षण सीधे नेटवर्क एक्सेस के बिना करता है। Hugging Face से जुड़े घटनाक्रम में एजेंट इंटरनेट तक तभी पहुँच सके जब उन्होंने मिली कमजोरी का फायदा उठाया।

OpenAI के एक अन्य कर्मचारी Michael Dalton ने बताया कि कई टीमों ने अस्थायी रूप से ऐसे खतरों की रोकथाम, पहचान और प्रतिक्रिया प्रणालियों को मजबूत करने पर ध्यान केंद्रित किया। OpenAI ने कुछ शोध की रफ्तार भी धीमी की और AI एजेंटों की निगरानी काफी बढ़ा दी। Dalton के अनुसार पूरी तरह स्वचालित आक्रामक प्रणालियों के लिए उतनी ही स्वचालित रक्षा की जरूरत होगी, जो उद्योग के पास अभी नहीं है।