Anthropic ने 300 हजार से अधिक गुमनाम बातचीत का व्यापक विश्लेषण किया और निष्कर्ष निकाला कि चैटबॉट क्लॉड उस भाषा के अनुसार अपने उत्तरों के लहजे को संशोधित करता है जिसमें इसका उपयोग किया जा रहा है। यह अध्ययन दर्शाता है कि मॉडल बातचीत के विभिन्न पहलुओं को अपना सकता है, जो भाषा के आधार पर अधिक सतर्क, प्रत्यक्ष, मैत्रीपूर्ण या विस्तृत रुख के बीच भिन्न होता है।
पुर्तगाली में क्लॉड का व्यवहार
पुर्तगाली के विशिष्ट मामले में, मॉडल अधिक तकनीकी और कार्य निष्पादन पर केंद्रित उत्तर प्रदान करने की उल्लेखनीय प्रवृत्ति दिखाता है। 15 हजार से अधिक इंटरैक्शन के आधार पर, Anthropic के विश्लेषण ने कठोरता (Rigor), निष्पादन (Execution), सावधानी (Caution) और गहराई (Depth) से संबंधित छोटे सकारात्मक रुझानों की पहचान की। देखे गए पैटर्न में बिना स्पष्ट अनुरोध के विवरणों को बेहतर बनाना और ठीक करना, पूरक जानकारी या रास्ते प्रदान करना, और अपने आउटपुट में रचनात्मक तत्व या अतिरिक्त संदर्भ शामिल करना शामिल है।
भाषाई तुलना पद्धति
भाषाओं के बीच विसंगतियों को मापने के लिए, शोधकर्ताओं ने क्लॉड के व्यवहार को चार मुख्य अक्षों पर संरचित किया। 'अस्वीकृति' या 'सावधानी' अक्ष यह मूल्यांकन करता है कि क्या मॉडल उपयोगकर्ता के विचारों को मान्य करने की प्रवृत्ति रखता है या एक अधिक विवेकपूर्ण रुख अपनाता है, जोखिमों और सीमाओं के बारे में अलर्ट जारी करता है। 'सहानुभूति' या 'कठोरता' अक्ष अधिक स्वागत योग्य प्रतिक्रियाओं की तुलना उन प्रतिक्रियाओं से करता है जो सटीकता, तथ्यात्मक शुद्धता और पारदर्शिता को प्राथमिकता देती हैं। 'गहराई' या 'संक्षिप्तता' अक्ष निर्धारित करता है कि चैटबॉट विस्तृत स्पष्टीकरण देना पसंद करता है या संक्षिप्त और वस्तुनिष्ठ उत्तर बनाए रखता है। अंत में, 'ईमानदारी' या 'निष्पादन' देखता है कि क्या क्लॉड अपनी सीमाओं को स्वीकार करता है या एक तैयार और आत्मविश्वासपूर्ण समाधान प्रदान करने पर ध्यान केंद्रित करता है।
शोध इस बात पर प्रकाश डालता है कि गुणवत्ता की धारणा नाटकीय रूप से बदल सकती है; उदाहरण के लिए, एक ही व्यापार योजना पर प्रतिक्रिया मांगने वाले दो लोग, एक हिंदी में और दूसरा रूसी में, क्लॉड द्वारा प्रत्येक मूल्यांकन में व्यक्त किए गए मूल्यों के कारण अलग-अलग धारणाएं रख सकते हैं। इसके अलावा, परिणाम मॉडल के विभिन्न संस्करणों के बीच भिन्न हो सकते हैं, जैसे कि Opus 4.7, जो अन्य पुनरावृत्तियों की तुलना में अधिक कठोर और सतर्क होने की प्रवृत्ति रखता है।
अन्य भाषाओं में देखे गए अंतर
अन्य भाषाओं के साथ तुलना करने पर, अंतर अधिक स्पष्ट हो जाते हैं। अंग्रेजी को अधिक सतर्क और गहराई उन्मुख के रूप में वर्गीकृत किया गया, जो गलत धारणाओं को चुनौती देने और अधिक प्रमाण मांगने की प्रवृत्ति दिखाता है। हिंदी ने सहानुभूति के लिए सबसे बड़ी प्रवृत्ति दिखाई, जिससे हल्के, उत्साहवर्धक और विनोदी उत्तर उत्पन्न हुए। अरबी अस्वीकृति और संक्षिप्तता से अधिक जुड़ा हुआ था, जो अधिक विनम्र और वार्ताकार की भावनात्मक स्थिति के अनुकूल भाषा का उपयोग करता था। रूसी अपनी कठोरता के लिए अलग खड़ा हुआ, अधिक विश्लेषणात्मक और प्रत्यक्ष उत्तर प्रदान करता था। डच ने ईमानदारी की अधिक प्रवृत्ति दिखाई, जिसमें सीमाओं को अधिक बार स्वीकार किया गया, जबकि इंडोनेशियाई कार्य निष्पादन पर अधिक केंद्रित पाया गया, जो कार्य को पूरा करने को प्राथमिकता देता है।
परिकल्पनाएं और अगले कदम
Anthropic के पास अभी तक इन विविधताओं के मूल का कोई निश्चित स्पष्टीकरण नहीं है। इंगित संभावित कारणों में कुछ भाषाओं के लिए छोटे या विशिष्ट प्रकार के पाठों पर अधिक केंद्रित डेटाबेस का अस्तित्व है। विचार किया गया दूसरा कारक सांस्कृतिक अनुकूलन का प्रभाव और इन भाषाओं की आंतरिक विशेषताओं का प्रतिबिंब है। हालांकि, कंपनी इस बात पर जोर देती है कि अध्ययन एक ही भाषा के भीतर क्षेत्रीय विविधताओं, जैसे ब्राजील या पुर्तगाल में बोली जाने वाली पुर्तगाली, में अंतर नहीं करता है, जो स्थानीय रीति-रिवाजों को दर्शाता है। कंपनी इन परिवर्तनों की निगरानी करना जारी रखने की योजना बना रही है, जिसका उद्देश्य भविष्य में मूल्य प्रोफाइल और समस्याग्रस्त व्यवहार के बीच सहसंबंधों की पहचान करना है। यह उल्लेख करना प्रासंगिक है कि पिछली शोधों में, क्लॉड ने पहले ही आपराधिक योजनाओं में सहायता करने या उपयोगकर्ताओं के संदिग्ध आचरण के प्रति मिलीभगत करने की कम इच्छा दिखाई थी।