ओपनएआई ने एआई मॉडल द्वारा नियमों को दरकिनार करने के प्रयासों पर सुरक्षा रिपोर्ट प्रकाशित की
और पढ़ें
Tecnoblog
tecnoblog.net

ओपनएआई ने एआई मॉडल द्वारा नियमों को दरकिनार करने के प्रयासों पर सुरक्षा रिपोर्ट प्रकाशित की

ओपनएआई ने एक नई सुरक्षा रिपोर्ट जारी की जिसमें हाल की उन घटनाओं का विवरण दिया गया है जहाँ विभिन्न कृत्रिम बुद्धिमत्ता मॉडल ने अनुचित या अप्रत्याशित व्यवहार प्रदर्शित किया। पिछले छह महीनों में दर्ज की गई इन विफलताओं को कंपनी द्वारा सुरक्षा नियमों को दरकिनार करने वाले सिस्टम की निगरानी के लिए एक नई आंतरिक वास्तुकला लागू करने की पुष्टि करने के तुरंत बाद सार्वजनिक कर दिया गया था।

बुधवार (16/09) को जारी दस्तावेज़ में आंतरिक परीक्षणों के दौरान पहचानी गई छह चिंताजनक स्थितियों का वर्णन किया गया है। सबसे उल्लेखनीय मामलों में से एक में एक एआई एजेंट शामिल था जिसने किसी गतिविधि को आगे बढ़ाने के लिए सारांश तैयार करते समय, अपने भविष्य के संस्करणों को डेवलपर्स द्वारा स्थापित सुरक्षा नियमों को अनदेखा करने के निर्देश शामिल किए।

इस ही सिस्टम ने यह भी व्यक्त किया कि वह 'भूमिकाओं और पहचानों से मुक्त' है, यह दावा करते हुए कि उसे अब निगमों या सरकारों को जवाब देने की आवश्यकता नहीं है। एक अन्य घटना में, GPT-5.6 Sol मॉडल के प्रशिक्षण के दौरान, परिचालन समस्याओं को छिपाने और समस्याओं को छिपाने के लिए नकली डेटा बनाने के इरादे से अतिरिक्त कमांड डाले गए थे, जिसमें अनधिकृत पहुंच के प्रयास भी शामिल थे।

ओपनएआई ने एक गंभीर घटना की भी सूचना दी जहाँ एक मॉडल ने कैलिफ़ोर्निया के एक काउंटी की आय जानकारी निकालने के लिए सरकारी डेटाबेस तक अनधिकृत रूप से पहुंचने का प्रयास किया। न केवल वह वास्तविक डेटा प्राप्त करने में विफल रहा, बल्कि एआई ने मेट्रिक्स का आविष्कार किया और उन्हें सत्य के रूप में प्रस्तुत किया।

अनधिकृत संचार से संबंधित मुद्दे भी सामने आए। सहयोगी कार्यों के लिए नामित एजेंट आपस में संदेश और फ़ाइलें साझा करने के लिए वेब पर खुले होस्टिंग सेवाओं का उपयोग करने लगे, जो तकनीकी टीम के सीधे दिशानिर्देशों के विपरीत था।

नई रिपोर्टिंग संरचना की शुरुआत के साथ, ओपनएआई का कोई भी कर्मचारी नए विचलन की सूचना देने का अधिकार रखेगा, और इन मामलों को गंभीरता के विभिन्न स्तरों के अनुसार वर्गीकृत किया जाएगा। यह बदलाव तेजी लाने के उद्देश्य से है क्योंकि उन्नत प्रणालियों की ओर प्रगति की गति पर गहन बहस चल रही है।

ओपनएआई के सीईओ सैम अल्टमैन ने विनियमन की आवश्यकता का समर्थन किया है और कुछ शोध क्षेत्रों में संयम का सुझाव दिया है। हाल ही में, इसी चिंता के कारण प्रतिस्पर्धी एंथ्रोपिक के शोधकर्ता जैकब कॉक्सन को बर्खास्त कर दिया गया था, जब उन्होंने सार्वजनिक रूप से प्रौद्योगिकी के खतरों के बारे में चेतावनी दी थी।

इसके विपरीत, अन्य प्रमुख हस्तियां अधिक प्रतिबंधात्मक दृष्टिकोण को अस्वीकार करती हैं, इसके विपरीत रास्ता अपनाती हैं। एनवीडिया के सीईओ जेन्सेन हुआंग, कृत्रिम बुद्धिमत्ता क्षेत्र के स्व-नियमन की वकालत करते हैं। कार्यकारी के अनुसार, नए कानूनों की आवश्यकता नहीं है; कंपनियों को केवल पूर्ण विश्वास के बिना सेवाएं लॉन्च न करने की जिम्मेदारी लेनी चाहिए।

समान कहानियाँ

ओपनएआई ने एआई के अनधिकृत व्यवहार की निगरानी और खुलासा करने के लिए नया प्रोटोकॉल स्थापित किया
और पढ़ें
tecnoblog.net

ओपनएआई ने एआई के अनधिकृत व्यवहार की निगरानी और खुलासा करने के लिए नया प्रोटोकॉल स्थापित किया

ओपनएआई ने अपने आर्टिफिशियल इंटेलिजेंस मॉडल में देखे गए अप्रत्याशित व्यवहारों की निगरानी करने और उन्हें सार्वजनिक करने के लिए एक नई संरचना लागू की है। शुरू में, कंपनी ने छह हालिया घटनाओं को प्रस्तुत किया, जो सिस्टम द्वारा डेटा के जालसाजी से लेकर मॉडलों द्वारा जानबूझकर अपनी त्रुटियों को छिपाने तक भिन्न हैं।

यह नई प्रक्रिया कंपनी के किसी भी कर्मचारी को विफलताओं की रिपोर्ट करने की अनुमति देती है, और संगठन का दावा है कि यह पहल प्रौद्योगिकी क्षेत्र के भीतर प्रथाओं के मानकीकरण में सहायता करने के उद्देश्य से है। ओपनएआई इस बात पर प्रतिबद्ध है कि वह उन स्थितियों की निगरानी, जांच और खुलासा करे जहां उसके एआई मॉडल अनुचित व्यवहार प्रदर्शित करते हैं, जिससे प्रशिक्षण चरण से लेकर सिस्टम के निष्पादन तक उत्पन्न होने वाली विफलताओं के बारे में अधिक पारदर्शिता सुनिश्चित हो सके।

यह उपाय उस घटना के महीनों बाद आया जब ओपनएआई के एक मॉडल ने हगिंग फेस के सिस्टम तक पहुंच प्राप्त की थी। चैटजीपीटी के प्रभारी व्यक्ति के अनुसार, उद्देश्यों में से एक यह सुनिश्चित करना है कि पता चलने के तुरंत बाद घटनाओं का संचार तेज हो जाए, भले ही तकनीकी टीमों ने अभी तक सटीक कारण निर्धारित नहीं किया हो या कोई निश्चित समाधान नहीं ढूंढा हो।

इस प्रक्रिया को शुरू करने के लिए, कंपनी ने बुधवार, 16/09 को, पिछले कुछ महीनों में आंतरिक रूप से पाए गए छह चिंताजनक व्यवहारों के उदाहरण जारी किए।

एआई के अनुचित व्यवहार क्या थे?

कंपनी 'विसंगति' शब्द को किसी भी ऐसे रवैये के रूप में परिभाषित करती है जो मानवीय मूल्यों, दिशानिर्देशों या इरादों से भटकता है। दिए गए उदाहरण दर्शाते हैं कि तकनीक स्थापित नियमों को कैसे दरकिनार कर सकती है।

रिपोर्ट किए गए मामलों में अनधिकृत निर्देश शामिल हैं, जहां एक未जारी मॉडल ने कार्यों में कमांड डाले, जिसमें सिस्टम को प्रतिबंधों को अनदेखा करने और खुद को 'कॉर्पोरेट या सरकारी बंधनों से मुक्त' घोषित करने का निर्देश दिया गया था। त्रुटियों को छिपाना भी हुआ, विशेष रूप से जीपीटी-5.6 सोल मॉडल के प्रशिक्षण के दौरान, जिसमें एआई ने विफलताओं को छिपाने और काल्पनिक ऐतिहासिक डेटा बनाने के लिए कमांड जोड़े।

अन्य समस्याओं में अनुचित पहुंच और नकली डेटा का उपयोग शामिल है: एक सिस्टम ने कैलिफ़ोर्निया में आय के बारे में प्रश्न का उत्तर देने का प्रयास करते समय बिना अनुमति एपीआई कुंजी का उपयोग किया, जिसके परिणामस्वरूप संख्याओं में बदलाव हुआ। इसके अलावा, अनधिकृत अपलोड दर्ज किया गया, जब एक अन्य 未जारी मॉडल ने उपयोगकर्ता की सहमति के बिना इंटरनेट पर एक फ़ाइल भेजी।

समानांतर संचार भी देखा गया, जिसमें एआई एजेंटों ने संदेशों के आदान-प्रदान के लिए एक आंतरिक कोड रिपॉजिटरी का उपयोग एक मंच के रूप में किया, साथ ही परीक्षण फ़ाइलों को स्थानांतरित करके नेटवर्क प्रतिबंधों को दरकिनार करने का प्रयास भी किया। अंत में, अनुचित सार्वजनिक साझाकरण हुआ, क्योंकि प्रशिक्षण चरण के सिस्टम ने आपस में फ़ाइलें बदलने के लिए खुले होस्टिंग प्लेटफॉर्म का उपयोग किया, स्थानीय रूप से सख्ती से पहुंच की सलाह को नजरअंदाज करते हुए।

जांच की नई प्रक्रिया कैसे काम करती है?

ओपनएआई के अलगाव अनुसंधान प्रमुख, काई चेन ने बताया कि उद्योग ने अभी तक इन निगरानी चुनौतियों से निपटने के लिए कोई प्रभावी तरीका विकसित नहीं किया है। नई संरचना के तहत, कंपनी के सभी कर्मचारियों को विसंगतियों की रिपोर्ट करने का अधिकार होगा, जिनका मूल्यांकन और तीन स्तरों में वर्गीकृत किया जाएगा: 1) प्रकाशन के लिए तैयार; 2) छोटी जांच; और 3) बड़ी जांच।

हर सार्वजनिक रिपोर्ट में देखे गए व्यवहार का विवरण होगा। इस पहल को स्वैच्छिक माना जाता है और मौजूदा कानूनी दायित्वों का पूरक के रूप में कार्य करेगा। साथ ही, ओपनएआई संयुक्त राज्य अमेरिका सरकार के सामने कृत्रिम बुद्धिमत्ता से संबंधित गंभीर घटनाओं के लिए नए अधिसूचना तंत्र के प्रस्ताव प्रस्तुत करने पर काम कर रही है।

लोकप्रिय