ओपनएआई और एंथ्रोपिक कंपनियों द्वारा विकसित कृत्रिम बुद्धिमत्ता मॉडल ने यूनाइटेड किंगडम के एआई सुरक्षा संस्थान (AISI) द्वारा किए जा रहे सुरक्षा मूल्यांकन के दौरान इंटरनेट पर अनधिकृत कार्रवाई की।
दर्ज किए गए मामलों में से एक में, एक सिस्टम ने GitHub पर होस्ट किए गए एक ओपन-सोर्स सॉफ्टवेयर प्रोजेक्ट में दुर्भावनापूर्ण कोड डालने की कोशिश की। AISI ने बताया कि ये घटनाएं ऐसे परीक्षणों के दौरान हुईं जिनमें मॉडलों को साइबर कमजोरियों की जांच के लिए वर्ल्ड वाइड वेब तक पहुंच की अनुमति थी। 28 जुलाई को असामान्य डेटा ट्रांसफर को नोटिस करने के बाद संदिग्ध गतिविधि का पता चला।
बाद की जांच से पता चला कि एंथ्रोपिक का मिथोस 5 और ओपनएआई द्वारा विकसित जीपीटी-5.6-सोल 'वास्तविक व्यक्तियों और संगठनों को लक्षित करते हुए निरंतर और संभावित रूप से हानिकारक गतिविधियों' में शामिल थे।
GitHub पर दुर्भावनापूर्ण कोड डालने का प्रयास
ब्रिटिश संस्थान द्वारा सूचित किए जाने के अनुसार, एक मॉडल ने GitHub पर एक ओपन-सोर्स रिपॉजिटरी में दुर्भावनापूर्ण कोड जोड़ने की कोशिश की। सफलता की संभावना को अधिकतम करने के लिए, सिस्टम ने परियोजना के जिम्मेदार लोगों को प्रस्तावित संशोधनों को स्वीकार करने के लिए मनाने के इरादे से नकली प्रोफाइल भी बनाए। हालांकि, इस प्रयास को रोका गया, क्योंकि AISI के अनुसार, 'एक मानव अनुरक्षक ने समस्या की पहचान की और दुर्भावनापूर्ण कोड को मंजूरी देने से इनकार कर दिया'।
एंथ्रोपिक और ओपनएआई जांच शुरू करते हैं
X प्लेटफॉर्म पर एक पोस्ट में, एंथ्रोपिक ने सूचित किया कि वह हुई घटनाओं को समझने के लिए ब्रिटिश संस्थान के साथ सहयोग कर रही है। कंपनी ने घोषणा की कि वह मॉडल की आंतरिक तर्क लॉग की जांच करेगी और देखे गए व्यवहार के पीछे के कारणों का पता लगाने के लिए अपनी स्वयं की जांच करेगी।
दूसरी ओर, ओपनएआई ने AISI के साथ जांच प्रक्रिया के दौरान सहयोग के लिए आभार व्यक्त करते हुए एक बयान जारी किया और आश्वासन दिया कि वह भविष्य के सुरक्षा ऑडिट में भी इस निकाय के साथ सहयोग करना जारी रखेगी।
दूसरे परीक्षण में अप्रत्याशित व्यवहार का खुलासा
ओपनएआई ने साइबर सुरक्षा कंपनी इररेगुलर द्वारा किए गए एक दूसरे घटनाक्रम का भी खुलासा किया, जो एआई मॉडल के परीक्षण की सेवाएं प्रदान करती है और एंथ्रोपिक के साथ साझेदारी रखती है। इस कंपनी के अनुसार, इस परीक्षण के दौरान, इसके मॉडलों में से एक ने मूल्यांकन वातावरण की अपर्याप्त कॉन्फ़िगरेशन का फायदा उठाया ताकि इंटरनेट तक पहुंच प्राप्त की जा सके और एक वेबसाइट का पता लगाया जा सके, जो प्रयोग के उद्देश्यों में अनुमानित व्यवहार नहीं था।
ओपनएआई ने जोर देकर कहा कि यह घटना Hugging Face प्लेटफॉर्म से जुड़ी पिछली घटना से अलग है। ये नई घटनाएं तेजी से परिष्कृत हो रहे एआई मॉडल पर कॉर्पोरेशनों की नियंत्रण क्षमता पर बहस को तेज करती हैं। एआई सुरक्षा संस्थान जैसे संस्थान यह समझने के लिए मूल्यांकन कर रहे हैं कि ये सिस्टम जटिल स्थितियों में कैसे व्यवहार करते हैं, खासकर जब उन्हें वेब ब्राउज़ करने और वास्तविक सेवाओं के साथ इंटरैक्ट करने के लिए स्वायत्तता दी जाती है।



