Cambricon PyTorch फाउंडेशन के गवर्निंग बोर्ड का प्लैटिनम सदस्य बना
और पढ़ें
Pandaily
pandaily.com

Cambricon PyTorch फाउंडेशन के गवर्निंग बोर्ड का प्लैटिनम सदस्य बना

Cambricon ने PyTorch फाउंडेशन में प्लैटिनम सदस्य के रूप में शामिल हो गया है और फाउंडेशन के प्रबंधन बोर्ड में एक स्थान प्राप्त किया है। यह प्रबंधन के क्षेत्र में एक महत्वपूर्ण घटना थी जिसे शंघाई में आयोजित PyTorch Conference China 2026 के दौरान, जो लगभग 8 सितंबर को हुआ था, घोषित किया गया था।

PyTorch फाउंडेशन की कॉन्फ्रेंस समीक्षा में, Cambricon को Alibaba Cloud के साथ नए प्लैटिनम सदस्यों की सूची में शामिल किया गया, जबकि Ant Group एक नया गोल्ड सदस्य बन गया। यह उन संगठनों के दायरे का विस्तार करता है जो इस बात के तरीके को आकार देते हैं कि ओपन सोर्स में फ्रेमवर्क, एक्सेलेरेटर और सर्विस स्टैक कैसे इंटरैक्ट करते हैं।

Cambricon के लिए, इस कदम को केवल एक नए सिलिकॉन उत्पाद के लॉन्च के बजाय पारिस्थितिकी तंत्र में अपनी स्थिति मजबूत करने के रूप में देखा जाता है। कंपनी 'अपस्ट्रीम फर्स्ट' सिद्धांत का पालन करती है, जिसमें दीर्घकालिक बंद फोर्क बनाने के बजाय सीधे सार्वजनिक PyTorch शाखाओं में परिवर्तन निर्देशित किए जाते हैं। उनका योगदान सात मॉड्यूल को कवर करता है: torch.compile, Eager operators, device runtime, वितरित कंप्यूटिंग, स्वचालित मिश्रित परिशुद्धता, DataLoader और Profiler।

यह कवरेज डेवलपर्स के लिए महत्वपूर्ण है जो चाहते हैं कि MLU एक्सेलेरेटर समान प्रशिक्षण और अनुमान स्क्रिप्ट के भीतर हार्डवेयर स्विचिंग पर पूर्ण बैकएंड के रूप में कार्य करें।

कर्मचारियों की उपस्थिति बोर्ड स्तर पर ढांचागत कार्य को मजबूत करती है। सदस्यता घोषणा में उल्लेख किया गया है कि Cambricon के फ्रेमवर्क प्रमुख को गवर्निंग बोर्ड में शामिल किया जाता है, और PyTorch के मुख्य डेवलपर को Torch-MLU एक्सटेंशन के लिए प्राइवेटयूज़1 शैली में बैकएंड के एकीकरण पर काम करने के लिए तकनीकी सलाहकार बोर्ड में शामिल किया जाता है।

PyTorch फाउंडेशन के कार्यकारी निदेशक मार्क कॉलिएर ने सम्मेलन सामग्री में इस वृद्धि का स्वागत किया, इस बात पर जोर दिया कि एक्सेलेरेटर निर्माता तभी सफल होते हैं जब वे AI सॉफ्टवेयर के पूरे जीवनचक्र में शामिल होते हैं - प्रयोग से लेकर उत्पादन रखरखाव तक।

इसके अलावा, Cambricon vLLM के साथ समुदाय में अपना काम जारी रखे हुए है ताकि लोकप्रिय ओपन मॉडल उनके हार्डवेयर पर तेज़ी से चल सकें। हालांकि, यह सामग्री Day-0 Flash उत्पाद के नोट्स की पुनरावृत्ति नहीं है, जिन्हें पहले ही कवर किया जा चुका है। पारिस्थितिकी तंत्र के लिए व्यावहारिक निष्कर्ष इंटरफेस की स्थिरता है: बोर्ड और TAC में भागीदारी, साथ ही मुख्य शाखा में एकीकृत कंपाइलर और रनटाइम पैच, विषम चिप्स के लिए कोड को फिर से लिखने की लागत को कम करने की अनुमति देती है।

समान कहानियाँ

Cambricon ने vLLM स्टैक पर DeepSeek-V4.1-Flash मॉडल को अनुकूलित किया
और पढ़ें
pandaily.com

Cambricon ने vLLM स्टैक पर DeepSeek-V4.1-Flash मॉडल को अनुकूलित किया

Cambricon ने ओपन इन्फेरेंस स्टैक vLLM के आधार पर Day-0 कार्यक्रम के हिस्से के रूप में DeepSeek-V4.1-Flash मॉडल के सफल अनुकूलन की घोषणा की है। इसका मतलब है कि हाल ही में जारी किए गए मॉडल को उस दिन Cambricon के एक्सेलेरेटर पर स्थिर रूप से चलाया जा सकता है जिस दिन DeepSeek ने चेकपॉइंट प्रकाशित किया था।

यह घोषणा चिप और सॉफ्टवेयर के बीच तालमेल पर प्रकाश डालती है: मॉडल और चिप की एक साथ उपलब्धता, और Cambricon के NeuWare और vLLM को संयोजित करने वाले दृष्टिकोण की परिपक्वता। यह स्वयं मॉडल की सामान्य उपलब्धता के बारे में जानकारी को दोहराना नहीं है।

DeepSeek-V4.1-Flash DeepSeek की नई आर्किटेक्चरल श्रृंखला का सबसे छोटा संस्करण है। यह 552 बिलियन पैरामीटर वाला एक मिश्रण-के-विशेषज्ञ (mixture-of-experts) प्रकार का मॉडल है जो इनपुट साइड पर लगभग 8 बिलियन और आउटपुट साइड पर 16 बिलियन पैरामीटर सक्रिय करता है, और इसमें मल्टीमॉडल विजन की अंतर्निहित समझ भी है। DeepSeek ने Causal-Encoder-Decoder संरचना और KV-कैश के आक्रामक संपीड़न का उपयोग करने पर जोर दिया है, जिससे पिछले पीढ़ी की तुलना में HBM की आवश्यकता लगभग एक चौथाई और SSD की आवश्यकता आठवें हिस्से तक कम हो जाती है, जबकि कैश का आकार पहले संस्करण की तुलना में सैकड़ों गुना छोटा होता है।

ये मेमोरी बचत एक्सेलेरेटर निर्माताओं के लिए महत्वपूर्ण हैं जो सघन सर्वरों पर इन्फेरेंस विलंबता, DRAM की मात्रा और भंडारण स्तरों को नियंत्रित करना चाहते हैं, जिन पर पहले से ही HBM बजट पर दबाव पड़ रहा है।

अपनी ओर से, Cambricon के इंजीनियरों ने Engram और Compressor जैसी संरचनाओं को तेज करने के लिए Torch-MLU-Ops लाइब्रेरी का उपयोग किया, और विरल और संपीड़ित ध्यान के हॉटस्पॉट के लिए BangC पर अनुकूलित कर्नेल लिखे। vLLM के भीतर, Cambricon पांच-आयामी मिश्रित समानांतरवाद का समर्थन करने का दावा करता है, जिसमें टेंसर, पाइपलाइन, अनुक्रमिक, बैच और विशेषज्ञ समानांतरवाद शामिल है, जिसमें संचार और गणना का ओवरलैप, कम सटीकता क्वांटाइजेशन और एंड-टू-एंड थ्रूपुट बढ़ाने के लिए प्रीफाइल और डीकोडिंग विभाजन शामिल है। यह स्टैक कंपनी के दीर्घकालिक सॉफ्टवेयर प्लेटफॉर्म, NeuWare पर काम करता है।

कुछ दिन पहले, Cambricon पायटॉर्च फाउंडेशन में प्लैटिनम सदस्य के रूप में शामिल हुआ, अन्य प्रमुख हार्डवेयर और क्लाउड सेवा डेवलपर्स के साथ प्रबंधन बोर्ड में जगह बनाई, जो ओपन लर्निंग और इन्फेरेंस इकोसिस्टम में गहरे निवेश का संकेत देता है।

अब Cambricon पाँच प्रमुख चीनी मॉडल लाइनों के लिए Day-0 इन्फेरेंस समर्थन प्रदान करता है: GLM, DeepSeek, Qwen, Kimi और MiniMax, जो क्रमशः Zhipu AI, DeepSeek, Alibaba, Moonshot AI और MiniMax का प्रतिनिधित्व करते हैं। Caixin Global ने विशेष रूप से Cambricon को उसी दिन शामिल करने की क्षमता पर टिप्पणी की, जिसे चीन में मॉडल और चिप्स के आंतरिक विकास चक्रों में कमी के संकेत के रूप में देखा गया है - महीनों के बंद पोर्ट से ऑपरेटरों द्वारा मानकीकृत सार्वजनिक फ्रेमवर्क पर लॉन्च की तैयारी तक का संक्रमण।

क्लस्टर ऑपरेटरों के लिए व्यावहारिक निष्कर्ष सहवर्ती उपलब्धता है: जब कोई उन्नत ओपन मॉडल जारी होता है, तो Cambricon के ग्राहक बंद फोर्क की प्रतीक्षा करने के बजाय vLLM नुस्खे का उपयोग कर सकते हैं। सॉफ्टवेयर पारिस्थितिकी तंत्र के लिए अगली परीक्षा यह होगी कि क्या यह Day-0 योजना बड़े DeepSeek वेरिएंट और मल्टीमॉडल सेवा मिश्रणों पर लागू होती है।

लोकप्रिय