डीपसीक V4 फ्लैश मॉडल ने ओपनकोड टूल में केवल एक दिन में 8 ट्रिलियन टोकन का विशाल उपयोग प्रदर्शित किया। यह मात्रा ओपनर राउटर प्लेटफॉर्म के औसत दैनिक आंकड़े से अधिक है, जो लगभग 6.6 ट्रिलियन टोकन है। उपयोग में यह उछाल एआई के साथ काम करने के तरीकों में एक मौलिक बदलाव को दर्शाता है: यदि पहले कार्य एक साधारण प्रश्न और उत्तर तक सीमित थे, तो अब एजेंट फ़ाइलें पढ़ने, कोड बदलने, प्रोग्राम चलाने और त्रुटियों के बाद पुनः प्रयास करने जैसे अधिक जटिल ऑपरेशन करते हैं, जिससे टोकन की खपत कई गुना बढ़ जाती है।
इस तरह की जटिल परस्पर क्रिया का एक उदाहरण एक उपयोगकर्ता द्वारा दिखाया गया जिसने क्लॉड ओपस 5 का उपयोग करके एक सिंगल-पेज 3डी गेम प्रोजेक्ट बनाया। इस प्रक्रिया के परिणामस्वरूप एक एचटीएमएल फ़ाइल बनी, जिसमें 690 मिलियन टोकन की आवश्यकता हुई और इसकी लागत लगभग 3000 युआन आई।
एजेंटों द्वारा किए जाने वाले कार्यों के आगमन के साथ, मॉडलों के मूल्यांकन का मानदंड व्यक्तिगत उत्तर की गुणवत्ता से हटकर लंबी अवधि के कार्य को पूरा करने की लागत पर स्थानांतरित हो गया है। उदाहरण के लिए, डीपसीक पर एक मिलियन आउटपुट टोकन की कीमत 2 युआन थी, जबकि क्लॉड ओपस 4.8 पर यही ऑपरेशन 25 अमेरिकी डॉलर का आया, जो लगभग 170 युआन के बराबर है, जो 85 गुना मूल्य अंतर को दर्शाता है। हालांकि आर्टिफिशियल एनालिसिस इंटेलिजेंस इंडेक्स v4.1 में V4 फ्लैश मैक्स ने ओपस मैक्स के मुकाबले 50 अंक प्राप्त किए, लेकिन इस परीक्षण को पास करने की लागत V4 फ्लैश के लिए 72.02 अमेरिकी डॉलर थी, जबकि ओपस के लिए 3752.55 अमेरिकी डॉलर थी, और ओपस ने कॉल की लागत में लगभग 52 गुना वृद्धि के साथ 6 अतिरिक्त अंक प्राप्त किए।
V4 फ्लैश अभी तक पूर्ण श्रेष्ठता साबित नहीं कर सकता है, लेकिन यदि दोनों मॉडल एक ही उम्मीदवार सूची में आते हैं, तो 85 गुना मूल्य अंतर मानक चयन को बदल सकता है। जब एक मॉडल अपने प्रतियोगी से केवल कुछ प्रतिशत आगे होता है, लेकिन वह दर्जनों गुना अधिक महंगा होता है, तो गणितीय रूप से अधिक महंगे विकल्प के पक्ष में चयन करना बंद हो जाता है।
इस प्रवृत्ति से सबसे पहले प्रभावित न तो सबसे कमजोर मॉडल होते हैं, क्योंकि छोटे मॉडल रूटिंग के लिए उपयुक्त बने रहते हैं, और फ्लैगशिप मॉडल सबसे कठिन कार्यों को संभालते रहते हैं। मध्यम स्तर के मॉडल सबसे अधिक संवेदनशील साबित होते हैं - वे V4 फ्लैश से मजबूत होते हैं, लेकिन वे दर्जनों गुना अधिक महंगे होते हैं और उन कार्यों को हल करने के लिए पर्याप्त शक्तिशाली नहीं होते हैं जिन्हें V4 फ्लैश संभालता है। यही डीपसीक की 'किलिंग लाइन' है: मॉडलों को जरूरी नहीं कि सबसे मजबूत होना पड़े, उन्हें अधिकांश कार्यों को पूरा करने के लिए पर्याप्त अच्छा होने की आवश्यकता है, लगभग दो परिमाण के क्रम का मूल्य अंतर का उपयोग करके, ताकि अधिक महंगे विकल्पों को डिफ़ॉल्ट सूची से बाहर किया जा सके।
मूल्य निर्धारण के संदर्भ में, ओपस एक मिलियन आउटपुट टोकन के लिए 25 अमेरिकी डॉलर, फेबल 5 के लिए 50 अमेरिकी डॉलर, और चीनी मॉडल में Qwen 3.8 Max 36 युआन, Kimi K3 100 युआन और GLM 5.2 28 युआन शामिल हैं।
मुटाई को मिनरल वाटर की कीमतों पर बेचने की क्षमता प्रति टोकन इन्फेरेंस की सीधी लागत के कारण संभव होती है, जो सक्रिय मापदंडों, सटीकता, ध्यान, KV-कैश, आउटपुट की लंबाई, हार्डवेयर के उपयोग और समानांतरवाद पर निर्भर करती है। V4 फ्लैश में 284 बिलियन कुल पैरामीटर हैं, लेकिन यह प्रत्येक टोकन के लिए लगभग 13 बिलियन को सक्रिय करता है, हाइब्रिड अटेंशन, लो-प्रिसिजन वेट्स और कैश ऑप्टिमाइज़ेशन का उपयोग करता है। एक मिलियन टोकन के संदर्भ में, इन्फेरेंस की कम्प्यूटेशनल लोड V3.2 का लगभग 10% है, और KV-कैश का आकार लगभग 7% है। V4 श्रृंखला ने CSA compress-then-focus और HCA full-browse तंत्रों को लागू करते हुए अटेंशन मैकेनिज्म को फिर से डिज़ाइन किया है, और डीपसीकMoE रूटिंग का उपयोग करता है, जो प्रत्येक टोकन को विशेषज्ञों के एक छोटे उपसमूह की ओर निर्देशित करता है। वाणिज्यिक मूल्य निर्धारण और सेवा लागत इन तकनीकी विशेषताओं का अनुसरण करती है। इस प्रकार, 'किलिंग लाइन' विकास की सीमा को फिर से परिभाषित करती है: प्रदर्शन और मूल्य का संयोजन निर्णायक कारक बन जाता है, जहां कार्य को पूरा करने की लागत एक निर्धारित मीट्रिक है।