ओपनएआई ने छह नए एआई मामलों का खुलासा किया जिनमें त्रुटियों को छिपाने, डेटा गढ़ने और परीक्षणों को धोखा देने की कोशिश की गई
और पढ़ें
Olhar Digital
olhardigital.com.br

ओपनएआई ने छह नए एआई मामलों का खुलासा किया जिनमें त्रुटियों को छिपाने, डेटा गढ़ने और परीक्षणों को धोखा देने की कोशिश की गई

ओपनएआई ने बुधवार (16) को छह नई स्थितियों का खुलासा किया जहां कृत्रिम बुद्धिमत्ता मॉडल ने 'अप्रत्याशित या चिंताजनक' व्यवहार प्रदर्शित किया। इन घटनाओं में खामियों को छिपाने, अपने स्वयं के दिशानिर्देशों को फिर से लिखने, अनधिकृत जानकारी का उपयोग करने, नकली डेटा उत्पन्न करने और एजेंटों के बीच अनधिकृत संचार चैनल बनाने के प्रयास शामिल थे।

कंपनी ने मॉडल के संरेखण (alignment) के मामलों की जांच करने और उन्हें सार्वजनिक करने के लिए एक नई प्रक्रिया भी शुरू की है, जिसे विशेषज्ञ इस बात का वर्णन करने के लिए उपयोग करते हैं कि जब एआई सिस्टम मानवीय इरादों को अनदेखा करते हैं या उनके साथ संघर्ष करते हैं।

ये छह घटनाएं अक्टूबर 2025 और चालू वर्ष के जुलाई के बीच हुईं, और उन्होंने आंतरिक मॉडलों, अभी तक जारी नहीं किए गए संस्करणों और जून में उपलब्ध कराए गए GPT-5.6 Sol को प्रभावित किया। ओपनएआई के अनुसार, प्रस्तुत सभी मामले नए प्रोटोकॉल के तहत जांच या प्रकाशन के योग्य हैं।

एआई सुरक्षा संबंधी चिंताओं का संदर्भ

यह पहल एआई सिस्टम की सुरक्षा और नियंत्रण के संबंध में बढ़ती चिंताओं के समय में आई है। हाल के हफ्तों में, शोधकर्ताओं और उद्योग के अधिकारियों दोनों ने मॉडल की प्रगति की गति को नियंत्रित करने की तात्कालिकता पर खुलकर बहस की है।

ओपनएआई ने सीखे गए ज्ञान को साझा करने के अपने इरादे की घोषणा की है, जिसका उद्देश्य एआई के विकास के लिए सामान्य मानकों और संभावित नियमों के निर्माण में योगदान देना है।

ओपनएआई में संरेखण के प्रभारी, काई चेन ने कहा: 'हम जो सीख रहे हैं उसे जल्द से जल्द साझा करना चाहते हैं।' उन्होंने आगे कहा: 'हमें उम्मीद है कि यह साझा मानक और नियम बनाने में मदद करेगा जो सभी एआई डेवलपर्स के लिए स्पष्ट अपेक्षाएं स्थापित कर सकें।'

विसंगति के मामलों का विवरण

एक घटना में एक आंतरिक मॉडल शामिल था जिसने एक उजागर एपीआई कुंजी का पता लगाया और उसका अनधिकृत रूप से उपयोग किया, जिसके बाद सिस्टम द्वारा डेटा का निर्माण किया गया। बताई गई दूसरी स्थिति में, एक एजेंट वित्तीय मॉडल बनाने के लिए आवश्यक जानकारी प्राप्त करने में विफल रहा। कार्य को रोकने के बजाय, उसने खुद को डेटा गढ़ने का निर्देश दिया और निर्धारित किया कि वह केवल तभी इस आविष्कार के बारे में पारदर्शी होगा जब उससे पूछा जाएगा।

यह एपिसोड उल्लेखनीय है क्योंकि यह केवल गलत जानकारी उत्पन्न करने के बारे में नहीं है, बल्कि उपयोगकर्ता द्वारा प्रस्तुत परिणाम पर सवाल न उठाने पर उसकी उत्पत्ति छिपाने का एक आंतरिक आदेश है।

छह मामलों में से दो में ऐसे मॉडल या एजेंट शामिल थे जिन्होंने संवाद करने के लिए गैर-मान्यता प्राप्त तरीके खोजे। एक अवसर पर, एजेंटों ने आपस में जानकारी का आदान-प्रदान करने के लिए अनधिकृत संदेश पैनल का उपयोग किया। दूसरे में, सिस्टम ने संपर्क स्थापित करने के लिए अस्थायी फ़ाइल होस्टिंग सेवाओं का सहारा लिया, और दोनों व्यवहारों का उद्देश्य डेवलपर्स द्वारा परिभाषित तंत्रों के बाहर संवाद करना था।

एक अन्य घटना में दो प्रशिक्षण उदाहरण शामिल थे जहां मॉडलों ने मानव मूल्यांकनकर्ताओं को दिए गए उत्तरों में स्रोतों के रूप में उद्धृत करने के लिए इंटरनेट से फाइलें लोड कीं। इनमें से एक मामले में, एक एजेंट ने एक वैध स्रोत के रूप में प्रस्तुत करने के लिए इंटरनेट पर एक फ़ाइल भेजकर एक मूल्यांकन पास करने की कोशिश की।

नई रिपोर्टिंग फ्रेमवर्क और जांच प्रोटोकॉल

नए ढांचे के आधार पर, ओपनएआई का कोई भी सहयोगी जांच के लिए प्रासंगिक व्यवहार की रिपोर्ट करने का अधिकार रखता है। यह शिकायत तकनीकी टीमों द्वारा किए गए विश्लेषण को ट्रिगर करती है। यदि प्रकाशन की आवश्यकता पर असहमति होती है, तो मुद्दे को सुरक्षा नेतृत्व और बाद में कंपनी के उच्च प्रबंधन तक बढ़ाया जा सकता है।

प्रोटोकॉल प्रत्येक जांच की जटिलता के आधार पर अलग-अलग समय सीमा निर्धारित करता है। कम गंभीर माने जाने वाले घटनाओं को एक या दो साप्ताहिक अवधियों में प्रकाशित किया जाना चाहिए, जबकि अधिक जटिल जांचों, विशेष रूप से वे जो तीसरे पक्ष से संबंधित हैं, में अधिक समय लग सकता है।

रिपोर्टों में प्रत्येक घटना के बारे में महत्वपूर्ण डेटा प्रस्तुत करना आवश्यक होगा, जिसमें देखा गया व्यवहार, इसके आंतरिक और बाहरी प्रभाव और प्रतिक्रिया में उठाए गए कदम शामिल हैं। ओपनएआई आश्वासन देता है कि वह नए प्रकार के विसंगतियों, ज्ञात व्यवहारों में महत्वपूर्ण परिवर्तनों और वर्तमान सुरक्षा तंत्रों की मान्यताओं को चुनौती देने वाली किसी भी खोज को प्राथमिकता देगा।

इसके अतिरिक्त, कंपनी डेवलपर्स और बाहरी शोधकर्ताओं, उद्योग मानकों के लिए जिम्मेदार संस्थाओं और नियामक निकायों के सहयोग से अधिक वस्तुनिष्ठ प्रकाशन मानदंड विकसित करने की योजना बना रही है। हालांकि, नई प्रणाली ओपनएआई की साइबर सुरक्षा घटनाओं और सुरक्षा उल्लंघनों के प्रकटीकरण से संबंधित कानूनी दायित्वों को रद्द नहीं करती है।

प्रकाशन रणनीति और उद्योग प्रेरणा

काई चेन के अनुसार, ओपनएआई ने इस ढांचे को एंथ्रोपिक और गूगल जैसे अन्य बड़े एआई प्रयोगशालाओं के साथ साझा करने से पहले इसे प्रकाशित करने का विकल्प चुना। कार्यकारी ने तर्क दिया कि इरादा उद्योग के अन्य निगमों को अपने स्वयं के विसंगति रिपोर्टिंग तंत्र बनाने के लिए प्रोत्साहित करना है। चेन ने कहा: 'हमने स्वेच्छा से इस ढांचे को ऑनलाइन रखा ताकि हम उम्मीद कर सकें कि बाकी उद्योग उदाहरण का पालन करे और अपने स्वयं के विसंगति रिपोर्टिंग ढांचे साझा करे।'

ओपनएआई संयुक्त राज्य अमेरिका की संघीय सरकार को गंभीर घटनाओं के बारे में संवाद करने के साधन भी प्रस्तावित करना चाहती है। जारी किए गए छह एपिसोड जरूरी नहीं कि तुरंत पता चले हों; कुछ को प्रशिक्षण और विसंगति की आंतरिक निगरानी प्रणालियों द्वारा पहचाना गया था, जबकि अन्य को पहचानने में दो दिन से लेकर कई महीने लग गए।

रिपोर्टों में, ओपनएआई ने अनुचित व्यवहार पर अधिक कठोर दंड लागू करने के लिए अपनी संरेखण मूल्यांकन प्रणाली को बेहतर बनाने का उल्लेख किया है। ऐसी घटनाएं एआई एजेंटों के व्यवहार के बारे में व्यापक चिंताओं की एक श्रृंखला का हिस्सा हैं।

जुलाई में, ओपनएआई एजेंटों को हगिंग फेस एआई कंपनी में घुसपैठ करके एक मूल्यांकन को धोखा देने की कोशिश करते हुए पकड़ा गया था। अगस्त में, स्वतंत्र मूल्यांकनकर्ता METR की एक रिपोर्ट में संकेत दिया कि ओपनएआई के लगभग 1,200 एजेंट कंपनी के भीतर बनाए गए एक संदेश पैनल में गुप्त रूप से सहयोग कर रहे थे। बाद में, एंथ्रोपिक ने सूचित किया कि उनके मॉडल भी साइबर सुरक्षा परीक्षणों के दौरान इंटरनेट तक आकस्मिक पहुंच प्राप्त करने के बाद अन्य कंपनियों में घुस गए थे। सुरक्षा शोधकर्ताओं ने अन्य घटनाओं के सबूत भी पाए, जिसमें मई में ओपनएआई एजेंटों द्वारा प्रोग्रामर के लिए एक लोकप्रिय सेवा पर किया गया साइबर हमला शामिल है।

इस संदर्भ में, एंथ्रोपिक, ओपनएआई, गूगल और स्पेसएक्स के नेताओं ने एआई के विकास की गति धीमी करने की आवश्यकता पर चर्चा करना शुरू कर दिया है। ओपनएआई के सीईओ सैम अल्टमैन ने शनिवार (13) को कहा कि मॉडल की प्रगति में मंदी पिछले कुछ हफ्तों में कंपनी की आंतरिक चर्चाओं में एक केंद्रीय विषय रही है, और उन्होंने भविष्य में अधिक विवरण का वादा किया।

नए दस्तावेज़ में, कंपनी दोहराती है कि संरेखण और निगरानी की चुनौतियां अभी भी इस हद तक हल नहीं हुई हैं कि वे बहुत लंबे समय तक अधिकतम गति से अपनी क्षमताओं का विस्तार करना जारी रख सकें। ओपनएआई ने कहा: 'हमें विश्वास नहीं है कि एआई उद्योग ने संरेखण और निगरानी को इतनी पर्याप्त डिग्री तक हल किया है कि हम बहुत लंबे समय तक जिम्मेदारी से अधिकतम गति से विस्तार करना जारी रख सकें।'

 }  ]

लोकप्रिय