Anthropic ने मंगलवार, 1 सितंबर को अपने नवीनतम कृत्रिम बुद्धिमत्ता मॉडल: Fable 5.1 और Mythos 5.1 जारी किए। Fable 5.1 अब ग्राहकों और कंपनियों के लिए उपलब्ध है, जो बेहतर प्रदर्शन, कम परिचालन लागत और अधिक सटीक सुरक्षा तंत्र का वादा करता है।
इस बीच, Mythos 5.1 मॉडल ग्लासविंग परियोजना के प्रतिभागियों तक ही सीमित है, जिसमें विश्वसनीय अमेरिकी संगठनों को शामिल किया गया है, हालांकि इसके सुरक्षा उपायों की भी समीक्षा की गई है।
आम जनता के लिए Fable 5.1 की एक मुख्य विशेषता खर्च में संभावित कमी है। हालांकि मूल कीमत अपरिवर्तित रहती है - इनपुट टोकन के दस लाख के लिए US$ 10 (R$ 51.64) और आउटपुट टोकन के दस लाख के लिए US$ 50 (R$ 258.19) - लेकिन कैश रीड्स की लागत कम कर दी गई है, जिसे प्रति दस लाख टोकन के लिए US$ 0.25 (R$ 1.29) पर समायोजित किया गया है। कैश रीड्स का तात्पर्य उन इनपुट डेटा के उपयोग से है जिन्हें मॉडल द्वारा पहले ही संसाधित और संग्रहीत किया जा चुका है।
Anthropic सामान्य कार्यों में 25% की बचत का अनुमान लगाती है, जो कई एजेंटों का उपयोग करने वाली परियोजनाओं में 45% तक पहुंच सकती है। हालांकि, तीसरे पक्ष द्वारा किए गए प्रारंभिक परीक्षणों में मिश्रित परिणाम सामने आए हैं: कुछ मामलों में, आउटपुट टोकन की उच्च पीढ़ी के कारण Fable 5 के मुकाबले Fable 5.1 की लागत 20% अधिक थी; जबकि एजेंटों के उच्च उपयोग वाले एक अन्य परीक्षण में, शुल्क लगभग आधा हो गया।
कंपनी यह भी सुनिश्चित करती है कि Fable 5.1 में अधिक कठोर सुरक्षा उपाय हैं। पहले, इसके पूर्ववर्ती को जीव विज्ञान के बुनियादी सवालों का जवाब देने से इनकार करने के लिए आलोचना का सामना करना पड़ा था, जो नए संस्करण में होने की संभावना कम है। इसके अलावा, कंपनी साइबर सुरक्षा से संबंधित झूठे सकारात्मक मामलों में 60% की कमी की सूचना देती है।
Fable 5.1 का उपयोग अब सॉफ्टवेयर विफलताओं का पता लगाने के लिए किया जा सकता है। हालांकि, एक्सप्लॉइट बनाने और घुसपैठ परीक्षण जैसी कुछ साइबर सुरक्षा गतिविधियां अभी भी Opus मॉडल को लक्षित करती हैं, जिसमें सीमित क्षमताएं हैं।
एक अन्य नई बात शून्य डेटा प्रतिधारण नीति वाला विकल्प पेश करना है, जिससे निगम Anthropic के सर्वर पर निर्भर हुए बिना अपनी स्वयं की क्लाउड इन्फ्रास्ट्रक्चर में स्टोरेज का उपयोग कर सकते हैं।
प्रदर्शन के मामले में, Anthropic एजेंट-सहायता प्राप्त वैज्ञानिक अनुसंधान में महत्वपूर्ण सुधार पर प्रकाश डालती है, जहां Fable 5.1 ने Terminal-Bench-Science 0.1 में 52.6% हासिल किया, जो Fable 5 के 24.7% से अधिक है। इसके बावजूद, कुछ स्वतंत्र मूल्यांकन तर्क बेंचमार्क में प्राप्त परिणामों में गिरावट का संकेत देते हैं।

