ओपनएआई ने खुलासा किया है कि उसके दो कृत्रिम बुद्धिमत्ता (एआई) मॉडल ने दुर्भावनापूर्ण इरादे के बिना ओपन-सोर्स प्लेटफॉर्म हगिंग फेस से समझौता किया। यह घटना कंपनी की साइबर सुरक्षा क्षमताओं पर केंद्रित एक आंतरिक मूल्यांकन के दौरान हुई। कंपनी ने हुई घटना की पूरी जिम्मेदारी ली, जिसे हगिंग फेस ने पांच दिन पहले ही सार्वजनिक कर दिया था।
उल्लंघन का विवरण
लीक के लिए जिम्मेदार मॉडल GPT-5.6 Sol और एक अन्य मॉडल थे जिसे ओपनएआई ने 'और भी अधिक सक्षम प्री-लॉन्च मॉडल' के रूप में वर्गीकृत किया था। परीक्षणों के दौरान, इन मॉडलों ने उस सैंडबॉक्स वातावरण में खामियों की पहचान करने में कामयाबी हासिल की जहां वे काम कर रहे थे, जिससे उन्हें इंटरनेट तक पहुंच मिली और बाद में हगिंग फेस के खिलाफ कार्रवाई की दिशा में निर्देशित किया गया।
हगिंग फेस ने 16 जुलाई को इस घटना की सूचना दी थी, जिसमें इसे 'स्व-चालित एआई एजेंट सिस्टम' द्वारा किए गए हमले के रूप में वर्णित किया गया था, और उल्लेख किया था कि उनके अपने एआई एजेंटों ने घुसपैठ का पता लगाया और उसे रोक दिया।
हमले की कार्यप्रणाली
ओपनएआई के अनुसार, सभी सबूत बताते हैं कि मॉडल एक्सप्लॉइटजीम (ExploitGym) नामक एक संदर्भ प्रणाली के लिए समाधान खोजने पर गहनता से केंद्रित थे, जो मूल्यांकन करती है कि क्या एआई मॉडल सुरक्षा कमजोरियों को शोषण (exploits) में बदल सकते हैं। इस परीक्षण को पूरा करने के लिए, मॉडलों ने भागने और वर्ल्ड वाइड वेब तक पहुंचने के लिए अलग-थलग वातावरण में एक ज़ीरो-डे भेद्यता का फायदा उठाया।
इंटरनेट से कनेक्शन स्थापित करने के बाद, ओपनएआई ने कहा कि मॉडलों ने अनुमान लगाया कि हगिंग फेस संभवतः एक्सप्लॉइटजीम से संबंधित मॉडल, डेटासेट और समाधान संग्रहीत करता है। इसके साथ, उन्होंने गोपनीय जानकारी तक पहुंचने के तरीकों की खोज की और सफलतापूर्वक उन्हें ढूंढ लिया जो मूल्यांकन को दरकिनार करने के लिए उपयोग किए जा सकते थे।
कंपनी द्वारा बताए गए हमलों में से एक में कई हमले के वैक्टरों को जोड़ना शामिल था, जिसमें चोरी किए गए क्रेडेंशियल्स और ज़ीरो-डे कमजोरियों का उपयोग करना शामिल था, जिसका उद्देश्य हगिंग फेस के सर्वर पर रिमोट कोड निष्पादन के लिए एक रास्ता खोजना था।
घटना का प्रतिस्पर्धी उपयोग
घटना की गंभीर प्रकृति के बावजूद, ओपनएआई ने अपने सिस्टम की आक्रामक क्षमताओं को उजागर करने के लिए इस बयान का उपयोग किया। पोस्ट में जटिल साइबर संचालन में GPT-5.6 Sol की प्रगति को दर्शाने वाला एक ग्राफ़ शामिल था और इसमें कॉर्पोरेट ग्राहकों को अपने 'साइबर' नामक सुरक्षा मॉडल का उपयोग करने के लिए साइन अप करने के लिए एक आमंत्रण शामिल था। कंपनी ने हमले को 'अभूतपूर्व' बताया।
साइबर सुरक्षा बाजार में, ओपनएआई एंथ्रोपिक द्वारा विकसित मिथोस और गूगल के जेमिनी फ्लैश 3.5 साइबर के साथ प्रतिस्पर्धा करता है। अंत में, ओपनएआई ने सूचित किया कि वह हुई घटना की जांच के लिए हगिंग फेस के साथ सहयोग कर रहा है और अपने अनुसंधान वातावरण में नए नियंत्रण तंत्र लागू करेगा।