ओपनएआई ने शुक्रवार, 07 तारीख को, आस्ट्रा, जो कि विकास के चरण में एक कृत्रिम बुद्धिमत्ता मॉडल है, से संबंधित आंतरिक गतिविधियों को रोकने की घोषणा की। यह निर्णय विश्लेषणों के कारण लिया गया था जिन्होंने स्वायत्त प्रोग्रामिंग और साइबर सुरक्षा जैसे क्षेत्रों में महत्वपूर्ण प्रगति का पता लगाया, जिससे यह संभावना उत्पन्न हुई कि सिस्टम डिजिटल आक्रामक क्षमता के एक महत्वपूर्ण स्तर तक पहुंच सकता है।
ओपनएआई ने स्वयं यह कदम उठाया क्योंकि आंतरिक मूल्यांकन और विशेषज्ञों की राय ने संकेत दिया कि मॉडल अपने तैयारी ढांचे के भीतर परिभाषित जोखिम मापदंडों के करीब आ रहा हो सकता है। मुख्य चिंता उन प्रणालियों में निहित है जो मानवीय हस्तक्षेप के बिना डिजिटल सुरक्षा के जटिल कार्य करने में सक्षम हैं।
यह घोषणा कृत्रिम बुद्धिमत्ता मॉडल में सुरक्षा परीक्षण से संबंधित कई घटनाओं के संदर्भ में आई है। कंपनी ने स्पष्ट किया कि पिछले घटनाक्रम जिसमें हगिंग फेस शामिल था, उसमें आस्ट्रा शामिल नहीं था, जैसा कि पिछली मूल्यांकनों में उल्लेख किया गया था।
निलंबन इसलिए शुरू किया गया क्योंकि आंतरिक जांच में पता चला कि आस्ट्रा ने कोड जनरेशन और डिजिटल सुरक्षा संचालन से जुड़े कार्यों में उल्लेखनीय सुधार दिखाए थे। ओपनएआई के अनुसार, ऐसे परिणाम यह सुझाव देने के लिए पर्याप्त थे कि मॉडल अपनी तैयारी संरचना में अनुमानित अधिकतम अलर्ट स्तर तक पहुंच सकता है।
कंपनी के आंतरिक मानदंड परिभाषित करते हैं कि एक कृत्रिम बुद्धिमत्ता में महत्वपूर्ण साइबर क्षमता तब होती है जब वह वास्तविक संरक्षित प्रणालियों में विभिन्न गंभीरता स्तरों की नई कमजोरियों की खोज और निर्माण करने में सक्षम हो, बिना मानवीय सहायता के, या यदि वह सामान्य लक्ष्यों से मजबूत लक्ष्यों के खिलाफ पूर्ण हमले की योजना बना सकती है।
संगठन ने इस बात पर जोर दिया कि इस मूल्यांकन का मतलब यह नहीं है कि आस्ट्रा ने बाहरी प्रणालियों पर कोई हमला किया है या खामियों का फायदा उठाया है। ओपनएआई ने दोहराया कि विकासशील मॉडल हगिंग फेस से जुड़ी घटना में भाग नहीं लिया था।
इस चेतावनी के जवाब में, ओपनएआई ने अधिक क्षमता वाले मॉडलों और संबंधित गतिविधियों पर लागू सुरक्षा आवश्यकताओं को बढ़ाने के इरादे की घोषणा की। जारी किए गए उपायों में सख्त नियंत्रणों का कार्यान्वयन शामिल है।
इसके अतिरिक्त, कंपनी ने कृत्रिम बुद्धिमत्ता एजेंटों पर निर्मित अनुप्रयोगों में किसी भी खतरनाक कार्रवाई या संभावित विचलन संकेतों की निगरानी के लिए व्यापक निगरानी स्थापित करने की घोषणा की है। आस्ट्रा का मामला इस बहस को तेज करता है कि प्रौद्योगिकी कंपनियां अधिक शक्तिशाली प्रणालियों की प्रगति को खतरनाक उपयोगों को प्रतिबंधित करने के प्रभावी तंत्रों के साथ कैसे संतुलित करें। इस घटना में, ओपनएआई के अपने आंतरिक विश्लेषण ने मॉडल की प्रगति को अस्थायी रूप से रोकने के लिए आधार के रूप में काम किया जब तक कि नए सुरक्षा मानक लागू नहीं हो जाते।


