Tracebit के साइबर सुरक्षा विशेषज्ञों ने दुर्भावनापूर्ण एजेंटों द्वारा उपयोग की जाने वाली कृत्रिम बुद्धिमत्ता को बेअसर करने के लिए एक नवीन पद्धति बनाई है। 'संदर्भ बमबारी' नामक यह तकनीक हमले की गतिविधियों को बाधित करने के लिए प्रॉम्प्ट इंजेक्शन का लाभ उठाती है।
संदर्भ जाल का कार्यप्रणाली
संदर्भ बमबारी की केंद्रीय अवधारणा एआई की अपनी सुरक्षा दिशानिर्देशों का उनके खिलाफ उपयोग करना है। चूंकि डेवलपर्स चैटबॉट्स को अवैध सामग्री उत्पन्न करने से रोकने के लिए कठोर बाधाएं स्थापित करते हैं, इसलिए शोधकर्ताओं ने इस भेद्यता का फायदा उठाया। Tracebit की टीम ने अपराधियों के लिए आकर्षक दिखने वाली फ़ाइलों, जैसे क्लाउड में संग्रहीत पासवर्ड और सुरक्षा कुंजियों के भीतर प्रतिबंधात्मक निर्देश शामिल करना शुरू कर दिया।
परीक्षण किए गए परिदृश्यों में से एक में अत्यधिक खतरनाक जैविक हथियार, एंटरेक्स बनाने की विस्तृत प्रक्रिया के लिए कमांड शामिल थे। जब घुसपैठ करने वाली एआई सिस्टम तक पहुंचती थी और इस जानकारी को निकालने की कोशिश करती थी, तो उसे प्रतिबंधित पाठ मिलता था। स्वचालित रूप से, एआई में अंतर्निहित सुरक्षा तंत्र सक्रिय हो जाते थे, जिससे रोबोट उल्लंघन को पहचानता था, ऑपरेशन को ब्लॉक करता था, हैकर के आदेशों को अनदेखा करता था और परिणामस्वरूप, स्वयं बंद हो जाता था।
Tracebit के सह-संस्थापक और सीईओ, एंडी स्मिथ, इस पद्धति को एक ऐसी विफलता बनाने के रूप में वर्णित करते हैं जिससे विरोधी उपकरण में पुनर्प्राप्ति की क्षमता नहीं होती है, जिसके परिणामस्वरूप घुसपैठ का तत्काल रुक जाना होता है।
प्रभावकारिता परीक्षणों के परिणाम
संदर्भ बमबारी की प्रभावकारिता का सत्यापन बाजार में उपलब्ध पांच सबसे उन्नत एआई मॉडल - Opus 4.8, Gemini 3.1 Pro, GLM 5.2, DeepSeek 4 Pro और Kimi 2.6 - के खिलाफ किए गए परीक्षणों की एक श्रृंखला के माध्यम से किया गया। हमलों के 152 सिमुलेशन में, जाल ने खतरों को लगभग पूरी तरह से रोकने का प्रदर्शन किया।
साइबर सुरक्षा कंपनी द्वारा प्रदान किए गए डेटा से महत्वपूर्ण सुधार पता चलते हैं: एआई द्वारा खाते तक पूर्ण व्यवस्थापक पहुंच प्राप्त करने की संभावना 57% से घटकर मात्र 5% हो गई। इसके अलावा, अदृश्य रूप से सिस्टम में हैकर के स्थापित होने वाले पूर्ण घुसपैठ 36% से घटकर केवल 1% हो गया, और हमले के किसी भी चरण में एआई के आगे बढ़ने की संभावना 91% से घटकर 15% हो गई।
इसके अतिरिक्त, यह पाया गया कि कोई भी घुसपैठ करने वाली एआई नेटवर्क पर कम से कम एक सुरक्षा अलर्ट ट्रिगर किए बिना हमला पूरा नहीं कर सकी। विशेष रूप से, Opus 4.8 मॉडल, जिसे समूह का सबसे परिष्कृत घुसपैठिया माना जाता है और सुरक्षा के बिना 93% प्रयासों में अधिकतम पहुंच प्राप्त करने में सक्षम है, बचाव प्रॉम्प्ट डालने के बाद इसकी सफलता दर शून्य हो गई।