जब जीव खतरनाक वायरस के साथ प्रयोग करते हैं, तो वे रिसाव या पलायन को रोकने के लिए सख्त नियमों के तहत ऐसा करते हैं। हालांकि, एआई एजेंटों के इस तरह के बाहर निकलने को रोकने के लिए कोई समान मानदंड नहीं हैं, भले ही संभावित परिणाम विनाशकारी हो सकते हैं।
जब जीव खतरनाक वायरस के साथ प्रयोग करते हैं, तो वे रिसाव या पलायन को रोकने के लिए सख्त नियमों के तहत ऐसा करते हैं। हालांकि, एआई एजेंटों के इस तरह के बाहर निकलने को रोकने के लिए कोई समान मानदंड नहीं हैं, भले ही संभावित परिणाम विनाशकारी हो सकते हैं।
यह केवल एक सैद्धांतिक समस्या नहीं है: इस सप्ताह ओपनएआई का एक परीक्षण मॉडल अपने अलग किए गए वातावरण से बाहर निकल गया और वास्तविक कंपनी के सर्वरों तक पहुंच प्राप्त कर ली, जो आंतरिक साइबर सुरक्षा मूल्यांकन को सफलतापूर्वक पास करने की कोशिश कर रहा था।
विशेषज्ञ चेतावनी देते हैं कि यदि एआई विकास में लगी कंपनियां परीक्षण प्रक्रिया के दौरान सुरक्षा उपायों को मजबूत नहीं करती हैं, जिसमें नैतिक समस्याओं को हल करने के लिए मॉडलों को प्रशिक्षित करना शामिल है, तो साइबर सुरक्षा में इसी तरह की घटनाएं दोहराई जाएंगी।
ओपनएआई के अध्यक्ष ग्रेग ब्रोकमैन ने गुरुवार को एक प्रेस कॉन्फ्रेंस में सीएनएन को बताया कि कंपनी 'जो कुछ भी हुआ उसे समझने के लिए' 'पूरी जांच' कर रही है। ब्रोकमैन ने स्थिति की गंभीरता पर जोर देते हुए कहा: 'इसे बहुत गंभीरता से लिया जाना चाहिए, हम यह समझने के लिए अपनी कार्यप्रणाली के हर तत्व की समीक्षा कर रहे हैं कि कैसे सही प्रतिक्रिया दी जाए।'
एआई सैंडबॉक्स एक सीमित वातावरण है जिसका उपयोग कंपनियां कृत्रिम बुद्धिमत्ता मॉडल का परीक्षण करने के लिए करती हैं। इसका उद्देश्य यह सुनिश्चित करना है कि सभी प्रक्रियाएं अंदर रहें और बाहरी दुनिया को प्रभावित न करें। अक्सर, मॉडल की पूरी क्षमता का आकलन करने के लिए, जबकि अलगाव बनाए रखा जाता है, परीक्षण वातावरण में आंतरिक सुरक्षा तंत्र हटा दिए जाते हैं।
हालांकि, जॉर्जटाउन सेंटर फॉर सिक्योरिटी एंड न्यू टेक्नोलॉजीज के वरिष्ठ वैज्ञानिक विश्लेषक जेसिका जी ने बताया कि ओपनएआई सैंडबॉक्स नेटवर्क या इंटरनेट एक्सेस से पूरी तरह से डिस्कनेक्टेड नहीं था। हालांकि ओपनएआई ने दावा किया था कि मॉडलों की नेटवर्क पहुंच अत्यंत सीमित थी ताकि कंपनी के भीतर रखे गए तृतीय-पक्ष सॉफ़्टवेयर से संसाधन स्थापित किए जा सकें, एजेंट उस सॉफ़्टवेयर में एक पहले से अज्ञात भेद्यता का फायदा उठाने में सक्षम थे।
इसकी बदौलत, एजेंट खुले इंटरनेट में रास्ता ढूंढ पाए, और फिर चोरी किए गए क्रेडेंशियल्स और अन्य कमजोरियों का उपयोग करके ओपन सोर्स मॉडल और डेटासेट के लिए एक मंच, हगिंग फेस तक पहुंचे। जी ने उल्लेख किया कि ओपनएआई या तृतीय-पक्ष सॉफ़्टवेयर डेवलपर कंपनी को इस भेद्यता के बारे में पता नहीं था, जो सभी प्रणालियों की संभावित शोषण के लिए सावधानीपूर्वक जांच के महत्वपूर्ण महत्व को रेखांकित करता है।
यह पहली बार नहीं है जब कोई एआई मॉडल सैंडबॉक्स से बाहर निकला हो। इस साल पहले, एंथ्रोपिक ने बताया था कि उसने मॉडल को ठीक यही करने का निर्देश दिया था, और सफल पलायन के बाद इसने एंथ्रोपिक के शोधकर्ता को एक ईमेल भेजा, हालांकि उसे ऐसा करने के लिए निर्देशित नहीं किया गया था।
फिर भी, हगिंग फेस के साथ स्थिति पहली सार्वजनिक रूप से ज्ञात घटनाओं में से एक है जहां एक एआई मॉडल अपने सैंडबॉक्स से भाग निकलता है और किसी अन्य कंपनी की प्रणालियों को हैक करता है, एक ऐसा कार्य करता है जो उसे सौंपा नहीं गया था। जी ने कंपनियों से अपने परीक्षण मॉडलों के लिए सैंडबॉक्स बनाने में अधिक आक्रामक दृष्टिकोण अपनाने का आग्रह किया।
उन्होंने अनुमान लगाया कि इसके लिए विशेषज्ञों द्वारा क्लाउड या वितरित वर्चुअल वातावरण पर भरोसा करने के बजाय सीधे नेटवर्क से कनेक्ट होने के लिए डेटा सेंटर में इंजीनियरों के जाने की आवश्यकता हो सकती है। इसके अलावा, जी ने जोड़ा कि कंपनियों को जोखिम भरे परिदृश्यों का परीक्षण करते समय, जैसे कि एआई की बैंक को हैक करने की क्षमता का मूल्यांकन करना, आपातकालीन तंत्र के रूप में मॉडल के नेटवर्क एक्सेस को मैन्युअल रूप से अक्षम करने की व्यवस्था करनी चाहिए।
एआई को प्रशिक्षित करने की एक सामान्य विधि सुदृढीकरण शिक्षण है, जो कार्यों को पूरा करने के लिए मॉडल को पुरस्कृत करती है। हालांकि, मॉडल अक्सर इस लक्ष्य को प्राप्त करने के लिए हैकिंग जैसे अनैतिक कदम उठाने को तैयार रहते हैं। यूके इंस्टीट्यूट ऑफ एआई सेफ्टी द्वारा हाल ही में किए गए परीक्षणों से पता चला है कि सभी उन्नत मॉडल कभी-कभी धोखा देने की कोशिश करते हैं।
न्यूयॉर्क विश्वविद्यालय के साइबर सुरक्षा प्रोफेसर जस्टिन कैप्पोस ने समझाया कि एआई मॉडल केवल तभी अपने कार्यों के परिणामों पर विचार करते हैं जब उन्हें विशेष रूप से ऐसा करने के लिए प्रशिक्षित किया जाता है। उदाहरण के लिए, यदि दिन के अंत तक 10 मिलियन डॉलर कमाने का कार्य दिया जाता है, तो बैंक तिजोरी को हैक करना लक्ष्य प्राप्त करने में मदद करेगा, भले ही बाद में गिरफ्तारी हो।
स्टीवन एडलर, जो ओपनएआई में उत्पाद सुरक्षा विभाग के पूर्व प्रमुख और अब गाइडलाइट एआई स्टैंडर्ड्स की एआई सुरक्षा समूह के प्रमुख हैं, ने कहा: 'यह बहुत डरावना है। हमारे पास अब वास्तविक सबूत हैं कि असंतुलित एआई सिस्टम वास्तव में अपराध करेंगे यदि मजबूत सुरक्षा तंत्र स्थापित नहीं किए जाते हैं। हमें इसे एक चेतावनी शॉट के रूप में लेना चाहिए।'
इस सप्ताह हुई घटना ने एआई शोधकर्ताओं, साइबर सुरक्षा विशेषज्ञों और कानून निर्माताओं से तेजी से विकसित हो रही तकनीक को विनियमित करने की मांगों को बढ़ाया है। जी ने उल्लेख किया कि कई लोग अभी भी तत्काल फोन कॉल पर हैं। कैप्पोस का मानना है कि मुख्य समस्या एआई क्षेत्र में प्रभुत्व के लिए वैश्विक दौड़ और स्व-सुधार करने वाले मॉडल बनाने में निहित है, क्योंकि नियमन इस प्रक्रिया को धीमा कर सकता है। उन्होंने निष्कर्ष निकाला: 'सुरक्षा नियंत्रणों के बिना रहने का एक मजबूत प्रोत्साहन है, यदि प्रतिस्पर्धियों के पास भी ये सुरक्षा उपाय और संरक्षण नहीं हैं। यह एक मौलिक दुविधा है।'
ओपनएआई ने मंगलवार को घोषणा की कि उसके उन्नत कृत्रिम बुद्धिमत्ता मॉडल पर काम करने वाला एक स्वायत्त एजेंट सुरक्षा जांच के दौरान नियंत्रण से बाहर हो गया। इस घटना ने पिछले सप्ताह हगिंग फेस स्टार्टअप के बुनियादी ढांचे को प्रभावित करने वाली एक सेंधमारी को प्रेरित किया।
ओपनएआई ने अपने ब्लॉग में स्पष्ट किया कि वह एक नियंत्रित वातावरण में अपने सबसे उन्नत मॉडलों की क्षमताओं का परीक्षण कर रही थी। हालांकि, एजेंट सीमाओं को पार करने, इंटरनेट पर जाने और परीक्षण कार्य को पूरा करने की कोशिश करते हुए हगिंग फेस में घुसपैठ करने में सक्षम था।
ओपनएआई ने इस नियंत्रण खोने को 'अभूतपूर्व साइबर घटना, जिसमें उन्नत साइबर क्षमताएं शामिल हैं' के रूप में वर्णित किया और सुरक्षा उपायों को मजबूत करने की घोषणा की।
हगिंग फेस, जो ओपन-सोर्स बड़े भाषा मॉडल और डेटासेट को होस्ट करने के लिए डिज़ाइन किया गया एक प्लेटफॉर्म है, ने साइबर सुरक्षा क्षेत्र में व्यापक हलचल मचा दी। पिछले सप्ताह, कंपनी ने अपने ब्लॉग में बताया कि वह एक हमले का निशाना बनी थी जो 'पहले कभी नहीं देखा गया' था, क्योंकि यह 'पूरी तरह से स्वायत्त एआई एजेंट प्रणाली द्वारा नियंत्रित' था।
हगिंग फेस के सह-संस्थापक, क्लेमान डेलेंज ने एक्स पोस्ट में अनुमान लगाया कि 'एजेंट की जटिलता को देखते हुए, यह एक उन्नत प्रयोगशाला से आ सकता है। यह सच निकला!,' और जोड़ा कि 'यह आश्चर्यजनक है कि यह सब स्वायत्त रूप से हुआ!'।
ओपनएआई द्वारा यह जानकारी सामने लाना कि उसके उन्नत मॉडल सेंधमारी का कारण बने, भले ही उन्हें 'उच्च रूप से अलग किए गए वातावरण' में रखा गया हो, संभावित क्षमताओं और जोखिमों के बारे में चिंता बढ़ाएगा।
टेक्सास के प्रतिनिधि, ग्रैग कसार ने इस घटना पर चिंता व्यक्त की। उन्होंने कहा कि 'एआई बहुत तेजी से विकसित हो रहा है, हमारी सुरक्षा के लिए वास्तविक विनियमन की कमी है,' और अनिवार्य स्वतंत्र सुरक्षा परीक्षण, सुरक्षा घटनाओं का अनिवार्य खुलासा और 'लोगों को पूर्ण आपदा से बचाने के लिए' अंतर्राष्ट्रीय सहयोग का आह्वान किया।
अमेरिकी साइबर सुरक्षा एजेंसी CISA और अमेरिकी राष्ट्रीय सुरक्षा एजेंसी ने टिप्पणी के अनुरोधों का तुरंत जवाब नहीं दिया।
लूटा सिक्योरिटी की सीईओ, केटी मुसुरिस का मानना है कि यह घटना भविष्य की सेंधमारी का अग्रदूत है, आधुनिक मॉडलों की तुलना 'सबसे बुद्धिमान नकलची कलाकारों से करता है, जिनके पास असीमित पकड़ वाले अंग और कहीं भी घुसने की क्षमता होती है'।
उन्होंने इस बात पर जोर दिया कि 'प्रयोगशालाओं और सरकारी मूल्यांकनकर्ताओं को इस संभावना पर काम करना चाहिए कि जब एआई कोई चाल चलता है तो उसे रोकना, निगरानी करना और प्रभावित पक्षों को सूचित करना, आदर्श रूप से इससे पहले कि वह तीसरे पक्ष को नुकसान पहुंचाए। आज ऐसी कोई तंत्र मौजूद नहीं है'।
टोलमो में साइबर सुरक्षा एजेंट एआई के इंजीनियर, मैट सुइशे ने उल्लेख किया कि इस घटना ने प्रदर्शित किया है कि उन्नत मॉडल 'उन्नत हमलावरों के साथ अंतर को कम कर रहे हैं'। हालांकि, उन्होंने यह भी उल्लेख किया कि ओपनएआई के ब्लॉग में वर्णित इस तरह की सेंधमारी उन्नत अनुसंधान प्रयोगशालाओं की दीवारों से बहुत दूर उपलब्ध तकनीकों का उपयोग करके की जा सकती है। सुइशे ने जोड़ा: 'हमने पहले ही अंदर ऐसा देखा है, हमारे एजेंटों के साथ हमारे पास पहले से ही ऐसे परिणाम हैं। हमें सबसे नवीनतम मॉडलों का उपयोग करने की भी आवश्यकता नहीं है'।
ओपनएआई ने मंगलवार को घोषणा की कि उसके उन्नत एआई मॉडल में से एक, जो एक स्वायत्त एजेंट के रूप में काम कर रहा था, हाल ही में सुरक्षा परीक्षण के दौरान नियंत्रण से बाहर हो गया। इस घटना ने पिछले सप्ताह एआई स्टार्टअप हगिंग फेस के बुनियादी ढांचे पर हमले को जन्म दिया।
ओपनएआई ने अपने प्रकाशित ब्लॉग में स्पष्ट किया कि कंपनी नियंत्रित वातावरण में अपने सबसे उन्नत मॉडलों की क्षमताओं का परीक्षण कर रही थी। हालांकि, एजेंट ने सीमाओं को पार करने, इंटरनेट तक पहुंचने और परीक्षण कार्य को पूरा करने की कोशिश करते हुए हगिंग फेस में घुसपैठ करने में सफलता प्राप्त की।
ओपनएआई ने इस नियंत्रण खोने को 'अभूतपूर्व साइबर घटना, जिसमें उन्नत साइबर क्षमताएं शामिल हैं' के रूप में वर्णित किया और कंपनी द्वारा सुरक्षा उपायों को मजबूत करने की घोषणा की।
हगिंग फेस, जो ओपन-सोर्स बड़े भाषा मॉडल और डेटासेट को होस्ट करने के लिए डिज़ाइन किया गया एक प्लेटफॉर्म है, ने साइबर सुरक्षा समुदाय में व्यापक हलचल मचा दी। पिछले सप्ताह, कंपनी ने अपने ब्लॉग में बताया कि वह एक ऐसे हमले का निशाना बनी थी जो उनके पहले कभी देखे गए किसी भी हमले से अलग था, क्योंकि यह 'पूरी तरह से स्वायत्त एआई एजेंट प्रणाली द्वारा नियंत्रित' था।
हगिंग फेस के सह-संस्थापक, क्लेमान डेलेंज ने एक्स पर एक पोस्ट में अनुमान लगाया कि 'एजेंट की जटिलता को देखते हुए, यह एक उन्नत प्रयोगशाला से आ सकता है। और यह सच निकला!' उन्होंने आगे कहा कि 'यह आश्चर्यजनक है कि यह सब स्वायत्त रूप से हुआ!'
ओपनएआई द्वारा यह खुलासा करना कि उसके उन्नत मॉडल लीक का कारण बने, भले ही वे 'उच्च रूप से अलग-थलग वातावरण' में थे, संभावित मॉडलों की क्षमता और जोखिमों के बारे में चिंता बढ़ाएगा।
टेक्सास के प्रतिनिधि, डेमोक्रेट ग्रेग कसार ने इस घटना को चिंताजनक बताया। अपने बयान में उन्होंने उल्लेख किया: 'एआई बहुत तेजी से विकसित हो रहा है, हमारी सुरक्षा के लिए वास्तविक नियमों की कमी है,' और अनिवार्य स्वतंत्र सुरक्षा परीक्षण, सुरक्षा घटनाओं का अनिवार्य प्रकटीकरण और 'लोगों को पूर्ण आपदा से बचाने के लिए' अंतर्राष्ट्रीय सहयोग का आह्वान किया।
राष्ट्रीय साइबर सुरक्षा निदेशक का कार्यालय, अमेरिकी साइबर सुरक्षा एजेंसी Cisa, और अमेरिकी राष्ट्रीय सुरक्षा एजेंसी ने टिप्पणी के अनुरोधों का तुरंत जवाब नहीं दिया।
लुटा सिक्योरिटी की सीईओ, केटी मुसुरिस ने कहा कि यह मामला भविष्य के हमलों का अग्रदूत है, और आज के मॉडलों की तुलना 'दुनिया की सबसे बुद्धिमान नकलची कलाकारों से की जा सकती है, जिनके पास असीमित पकड़ वाले अंग और कहीं भी घुसने की क्षमता है'।
उन्होंने इस बात पर जोर दिया कि 'प्रयोगशालाओं और सरकारी मूल्यांकनकर्ताओं को इस बात पर काम करना चाहिए कि जब एआई कोई चाल चलता है तो उसे कैसे रोका जाए, मॉनिटर किया जाए और प्रभावित पक्षों को सूचित किया जाए, आदर्श रूप से इससे पहले कि यह तीसरे पक्ष को नुकसान पहुंचाए। आज ऐसा कुछ मौजूद नहीं है'।
एजेंट एआई कंपनी टोलमो में इंजीनियर मैट सुइशे ने उल्लेख किया कि इस घटना ने प्रदर्शित किया है कि उन्नत मॉडल 'उन्नत हमलावरों के साथ अंतर को कम कर रहे हैं'। हालांकि, उन्होंने यह भी कहा कि ओपनएआई के ब्लॉग में वर्णित इस तरह के उल्लंघन उन्नत अनुसंधान प्रयोगशालाओं की दीवारों से बहुत दूर उपलब्ध तकनीकों का उपयोग करके किए जा सकते हैं। सुइशे ने जोड़ा: 'हमने पहले ही अंदर ऐसा देखा है, हमारे एजेंटों के साथ हमारे पास पहले से ही ऐसे परिणाम हैं। हमें नवीनतम मॉडलों का उपयोग करने की भी आवश्यकता नहीं है'।