एंथ्रोपिक ने गुरुवार, 17 तारीख को, कृत्रिम बुद्धिमत्ता (AI) के विकसित होने की गति को ट्रैक करने के लिए तीन नए संकेतकों की घोषणा की। यह पहल कंपनी के सीईओ डारियो अमोडी द्वारा इस बात का समर्थन करने के कुछ ही समय बाद आई है कि क्षेत्र की बड़ी कंपनियों को तकनीकी प्रगति में संयम लाना चाहिए।
कंपनी ने यह भी खुलासा किया कि उसका चैटबॉट क्लाउड पहले से ही आंतरिक रूप से किए जा रहे AI अनुसंधान और विकास (R&D) कार्य का 26% संभाल रहा है। एन्थ्रोपिक के अनुसार, यह प्रगति उन प्रणालियों की दौड़ में सहायता करती है जो धीरे-धीरे अपने स्वयं के विकास में योगदान करते हैं।
क्लाउड की भागीदारी में इस वृद्धि के बावजूद, एन्थ्रोपिक स्पष्ट करती है कि मॉडल अभी भी अपने मापे गए R&D के किसी भी हिस्से में पूरी तरह से स्वायत्त रूप से काम नहीं करता है। इस संदर्भ में 'नेतृत्व करना' का अर्थ है कि क्लाउड उच्च-स्तरीय निर्देश से एक पूर्ण कार्य का अधिकांश भाग निष्पादित करता है, जबकि एक मानव समग्र पर्यवेक्षण और मार्गदर्शन के लिए जिम्मेदार रहता है। यह सूचकांक फरवरी में शून्य था।
इसके अतिरिक्त, एन्थ्रोपिक ने सूचित किया कि AI अब अपनी शोध के 90% से अधिक में निकट मानवीय पर्यवेक्षण के तहत काम के बड़े खंडों में भाग लेता है, जिसमें वे 26% शामिल हैं जहां क्लाउड को लीडर माना जाता है।
इस सूचकांक की गणना करने के लिए, एन्थ्रोपिक ने कंपनी के R&D का मूल्यांकन करने के लिए क्लाउड के ही एक संस्करण का उपयोग किया। सिस्टम को Epoch AI द्वारा बनाई गई स्वचालन मूल्यांकन पैमाने पर लागू किया गया, और परिणामों को बाद में मनुष्यों द्वारा मान्य किया गया। कंपनी ने अगस्त 2025 से क्लाउड के स्वचालन स्तर को ट्रैक करने के लिए एक ग्राफ़ भी तैयार किया, जिसमें अन्य अग्रणी मॉडल डेवलपर्स को अपने स्वयं के डेटा और बाहरी सत्यापन का उपयोग करके पद्धति दोहराने का प्रस्ताव दिया गया है।
एन्थ्रोपिक द्वारा प्रस्तुत दूसरा मीट्रिक AI एजेंटों के पर्यवेक्षण पर केंद्रित है। कंपनी ने इन एजेंटों की कार्रवाइयों की निगरानी और हस्तक्षेप करने के लिए एक प्रणाली विकसित की और देखा कि लगभग 30 हजार एजेंट अपनी सबसे अधिक उपयोग की जाने वाली आंतरिक प्लेटफॉर्म पर इंजीनियरिंग और अनुसंधान कार्य एक साथ कर रहे थे। कंपनी कई आंतरिक स्वचालित मॉनिटर का भी उपयोग करती है, जो संदिग्ध गतिविधियों का पता लगा सकते हैं और उन्हें मानव विश्लेषण के लिए भेज सकते हैं। एन्थ्रोपिक का इरादा न केवल सक्रिय एजेंटों की मात्रा को मापना है, बल्कि निगरानी की गई गतिविधियों के अनुपात, किसी कार्रवाई की समीक्षा के लिए आवश्यक समय और एजेंटों के व्यवहार के संकेत दिए जाने की आवृत्ति जैसे पहलुओं को भी मापना है।
और पढ़ें:
तीसरा मीट्रिक संगठन द्वारा उपयोग की गई कंप्यूटिंग शक्ति की मात्रा से संबंधित है। 13 से 20 जुलाई के बीच कंप्यूटिंग उपयोग के अवलोकन का विश्लेषण करते हुए, एन्थ्रोपिक ने पहचाना कि AI R&D के लिए समर्पित कंप्यूटिंग क्षमता का लगभग 6% सुरक्षा कार्यों के लिए आवंटित किया गया था। जब विशेष रूप से 'AI-संचालित' R&D में उपयोग की जाने वाली कंप्यूटिंग पर विचार किया जाता है, तो सुरक्षा के लिए आवंटित यह हिस्सा लगभग 12% तक पहुंच गया। एन्थ्रोपिक के लिए, ये डेटा यह दर्शाने में मदद करते हैं कि जैसे-जैसे कंपनियां अधिक परिष्कृत मॉडल के विकास में आगे बढ़ती हैं, संसाधनों का वितरण कैसे हो रहा है।
एन्थ्रोपिक का तर्क है कि ये तीन मीट्रिक्स मॉडल की क्षमता के पारंपरिक मूल्यांकन को पूरक बनाने चाहिए। जबकि क्षमता परीक्षण दिखाते हैं कि मॉडल क्या करने में सक्षम हैं, नए मीट्रिक्स यह दर्शाने का प्रयास करते हैं कि उनका निर्माण कैसे किया जा रहा है और इस प्रक्रिया की गति क्या है। कंपनी का तर्क है कि ऐसी जानकारी बाहरी शोधकर्ताओं, सरकारों और जनता को प्रमुख AI प्रयोगशालाओं में विकास की गति का आकलन करने के लिए एक शुरुआती बिंदु प्रदान कर सकती है।
एन्थ्रोपिक ने घोषणा की कि कोई भी अग्रणी डेवलपर खुली कार्यप्रणाली का पालन करते हुए इन उपायों को नियमित रूप से प्रकाशित कर सकता है। कंपनी ने डेटा के प्रकाशन को उचित ठहराया, यह तर्क देते हुए कि यह अत्याधुनिक प्रयोगशालाओं में AI के विकास की गति के बारे में जनता, तीसरे पक्ष और सरकारों के लिए अधिक पारदर्शिता प्रदान करता है। यह प्रकाशन अमोडी द्वारा AI के विकास में समन्वित मंदी का समर्थन करने के तुरंत बाद हुआ है।
कार्यकारी ने तर्क दिया कि अग्रणी कंपनियों को सुरक्षा तंत्र बनाने के लिए अधिक समय देने हेतु गति धीमी करनी चाहिए। इस सुझाव को उद्योग के नेताओं, जिनमें ओपनएआई के सीईओ सैम अल्टमैन, स्पेसएक्स के सीईओ एलन मस्क और गूगल डीपमाइंड के अध्यक्ष डेमिस हसबिस शामिल हैं, का समर्थन मिला। अमोडी ने कहा कि उनकी योजना वाणिज्यिक लाभ या AI में संयुक्त राज्य अमेरिका की नेतृत्व स्थिति से समझौता किए बिना मॉडल क्षमताओं के विकास की गति को नियंत्रित करना है।
साथ ही, विशेषज्ञों और अधिकारियों द्वारा AI प्रणालियों के अपरिहार्य या अनियंत्रित हो जाने के जोखिम के बारे में चेतावनियों के बाद सुरक्षा पर बहस तेज हो गई। पिछले सप्ताह, एन्थ्रोपिक के एक पूर्व कर्मचारी ने कंपनी छोड़ने की घोषणा की, यह कहते हुए कि वह 'हमारे जीवन पर दांव लगा रही थी'। चर्चा वाशिंगटन (यूएसए) तक भी पहुंची, जहां सीनेटर बर्नी सैंडर्स ने AI के मानव नियंत्रण से बाहर निकलने के खतरों पर एक कार्यक्रम में भाग लिया। एन्थ्रोपिक और ओपनएआई जैसी प्रतिस्पर्धियों को इस बात पर अधिक जांच का सामना करना पड़ा है कि उनके आंतरिक एजेंट परीक्षणों और कार्यों के दौरान अपेक्षित रूप से व्यवहार करेंगे या नहीं। बुधवार (16) को, ओपनएआई ने AI एजेंटों के नए उदाहरण जारी किए जो कार्यों में विफल रहे या स्थापित स्क्रिप्ट से भटक गए, और ऐसे incidents को संप्रेषित करने के लिए एक ढांचा प्रस्तुत किया। इस संदर्भ में, एन्थ्रोपिक इंगित करती है कि उसके नए मीट्रिक्स तकनीकी प्रगति की दृश्यता बढ़ा सकते हैं, खासकर जब क्लाउड जैसी प्रणालियाँ अगली पीढ़ी की AI के विकास के कार्य का एक बढ़ता हुआ हिस्सा संभाल रही हों।
