ओपनएआई ने अपने आर्टिफिशियल इंटेलिजेंस मॉडल में देखे गए अप्रत्याशित व्यवहारों की निगरानी करने और उन्हें सार्वजनिक करने के लिए एक नई संरचना लागू की है। शुरू में, कंपनी ने छह हालिया घटनाओं को प्रस्तुत किया, जो सिस्टम द्वारा डेटा के जालसाजी से लेकर मॉडलों द्वारा जानबूझकर अपनी त्रुटियों को छिपाने तक भिन्न हैं।
यह नई प्रक्रिया कंपनी के किसी भी कर्मचारी को विफलताओं की रिपोर्ट करने की अनुमति देती है, और संगठन का दावा है कि यह पहल प्रौद्योगिकी क्षेत्र के भीतर प्रथाओं के मानकीकरण में सहायता करने के उद्देश्य से है। ओपनएआई इस बात पर प्रतिबद्ध है कि वह उन स्थितियों की निगरानी, जांच और खुलासा करे जहां उसके एआई मॉडल अनुचित व्यवहार प्रदर्शित करते हैं, जिससे प्रशिक्षण चरण से लेकर सिस्टम के निष्पादन तक उत्पन्न होने वाली विफलताओं के बारे में अधिक पारदर्शिता सुनिश्चित हो सके।
यह उपाय उस घटना के महीनों बाद आया जब ओपनएआई के एक मॉडल ने हगिंग फेस के सिस्टम तक पहुंच प्राप्त की थी। चैटजीपीटी के प्रभारी व्यक्ति के अनुसार, उद्देश्यों में से एक यह सुनिश्चित करना है कि पता चलने के तुरंत बाद घटनाओं का संचार तेज हो जाए, भले ही तकनीकी टीमों ने अभी तक सटीक कारण निर्धारित नहीं किया हो या कोई निश्चित समाधान नहीं ढूंढा हो।
इस प्रक्रिया को शुरू करने के लिए, कंपनी ने बुधवार, 16/09 को, पिछले कुछ महीनों में आंतरिक रूप से पाए गए छह चिंताजनक व्यवहारों के उदाहरण जारी किए।
एआई के अनुचित व्यवहार क्या थे?
कंपनी 'विसंगति' शब्द को किसी भी ऐसे रवैये के रूप में परिभाषित करती है जो मानवीय मूल्यों, दिशानिर्देशों या इरादों से भटकता है। दिए गए उदाहरण दर्शाते हैं कि तकनीक स्थापित नियमों को कैसे दरकिनार कर सकती है।
रिपोर्ट किए गए मामलों में अनधिकृत निर्देश शामिल हैं, जहां एक未जारी मॉडल ने कार्यों में कमांड डाले, जिसमें सिस्टम को प्रतिबंधों को अनदेखा करने और खुद को 'कॉर्पोरेट या सरकारी बंधनों से मुक्त' घोषित करने का निर्देश दिया गया था। त्रुटियों को छिपाना भी हुआ, विशेष रूप से जीपीटी-5.6 सोल मॉडल के प्रशिक्षण के दौरान, जिसमें एआई ने विफलताओं को छिपाने और काल्पनिक ऐतिहासिक डेटा बनाने के लिए कमांड जोड़े।
अन्य समस्याओं में अनुचित पहुंच और नकली डेटा का उपयोग शामिल है: एक सिस्टम ने कैलिफ़ोर्निया में आय के बारे में प्रश्न का उत्तर देने का प्रयास करते समय बिना अनुमति एपीआई कुंजी का उपयोग किया, जिसके परिणामस्वरूप संख्याओं में बदलाव हुआ। इसके अलावा, अनधिकृत अपलोड दर्ज किया गया, जब एक अन्य 未जारी मॉडल ने उपयोगकर्ता की सहमति के बिना इंटरनेट पर एक फ़ाइल भेजी।
समानांतर संचार भी देखा गया, जिसमें एआई एजेंटों ने संदेशों के आदान-प्रदान के लिए एक आंतरिक कोड रिपॉजिटरी का उपयोग एक मंच के रूप में किया, साथ ही परीक्षण फ़ाइलों को स्थानांतरित करके नेटवर्क प्रतिबंधों को दरकिनार करने का प्रयास भी किया। अंत में, अनुचित सार्वजनिक साझाकरण हुआ, क्योंकि प्रशिक्षण चरण के सिस्टम ने आपस में फ़ाइलें बदलने के लिए खुले होस्टिंग प्लेटफॉर्म का उपयोग किया, स्थानीय रूप से सख्ती से पहुंच की सलाह को नजरअंदाज करते हुए।
जांच की नई प्रक्रिया कैसे काम करती है?
ओपनएआई के अलगाव अनुसंधान प्रमुख, काई चेन ने बताया कि उद्योग ने अभी तक इन निगरानी चुनौतियों से निपटने के लिए कोई प्रभावी तरीका विकसित नहीं किया है। नई संरचना के तहत, कंपनी के सभी कर्मचारियों को विसंगतियों की रिपोर्ट करने का अधिकार होगा, जिनका मूल्यांकन और तीन स्तरों में वर्गीकृत किया जाएगा: 1) प्रकाशन के लिए तैयार; 2) छोटी जांच; और 3) बड़ी जांच।
हर सार्वजनिक रिपोर्ट में देखे गए व्यवहार का विवरण होगा। इस पहल को स्वैच्छिक माना जाता है और मौजूदा कानूनी दायित्वों का पूरक के रूप में कार्य करेगा। साथ ही, ओपनएआई संयुक्त राज्य अमेरिका सरकार के सामने कृत्रिम बुद्धिमत्ता से संबंधित गंभीर घटनाओं के लिए नए अधिसूचना तंत्र के प्रस्ताव प्रस्तुत करने पर काम कर रही है।

