XPeng ने दूसरी पीढ़ी के VLA मॉडल को समय की समझ जोड़कर और 4डी स्पेस-टाइम मॉडल में परिवर्तित करके अपडेट किया
और पढ़ें
Pandaily
pandaily.com

XPeng ने दूसरी पीढ़ी के VLA मॉडल को समय की समझ जोड़कर और 4डी स्पेस-टाइम मॉडल में परिवर्तित करके अपडेट किया

XPeng ने अपने विजन-लैंग्वेज-एक्शन (VLA) दूसरी पीढ़ी के मॉडल का सबसे महत्वपूर्ण अपडेट पेश किया है, जिसमें मुख्य परिवर्तन कृत्रिम बुद्धिमत्ता की समय पहलुओं को समझने की क्षमता है। 'समय' विषय पर भौतिक एआई के लिए आयोजित प्रस्तुति में, कंपनी ने घोषणा की कि उसके मूल मॉडल ने नए XOS 6.3.0 सॉफ़्टवेयर के साथ स्थिर त्रि-आयामी स्थानिक धारणा से गतिशील चार-आयामी स्पेस-टाइम समझ तक विकास किया है, जिसे G9L वाहन पर जारी किया गया है।

यह सफलता तीन तकनीकों पर आधारित है। पहला, Infini-VLA, एक बड़े क्षितिज वाला आर्किटेक्चर जो 30 सेकंड तक सड़क के दृश्य को याद रख सकता है, निरंतर ड्राइविंग घटनाओं को एक एकीकृत अस्थायी समझ में जोड़ता है। दूसरा, स्ट्रीमिंग इन्फेरेंस तकनीक मॉडल के कार्य को असतत तर्क से निरंतर समानांतर प्रसंस्करण में बदल देती है, जिससे शुरू से अंत तक विलंबता में 300% की कमी आती है। तीसरा, X-Foresight वर्ल्ड प्रेडिक्शन मॉडल आसपास के यातायात प्रतिभागियों के व्यवहार का छह सेकंड तक अनुमान लगाता है, जिससे अचानक लेन बदलने और अचानक ब्रेक लगाने पर प्रतिक्रिया में सुधार होता है।

डिवाइस पर चलने वाले पैरामीटर 3.5 गुना बढ़ गए हैं - यह मुख्य VLA मॉडलों की तुलना में 15 गुना से अधिक है, और समग्र बहुआयामी सुरक्षा 20 गुना बेहतर हो गई है। इसके अलावा, XPeng ने मास्टर एजेंट प्रस्तुत किया - एक सार्वभौमिक 'मस्तिष्क' जो किसी विशिष्ट वाहन से बंधा नहीं है और ओमनी मल्टीमॉडल मॉडल पर बनाया गया है। यह एजेंट VLA धारणा को VLM के केबिन के साथ एकीकृत करता है, स्वचालित रूप से उपयोगकर्ता के इरादों को समझता है और स्वायत्त ड्राइविंग, चेसिस और केबिन प्रणालियों का समन्वय करता है।

वॉयस द्वारा सक्रिय नई सुविधाएँ, जैसे रुकने का अनुरोध, वास्तव में रोबोटैक्सी की L4 स्तर की क्षमताओं को बड़े पैमाने पर उत्पादन में लाती हैं। यह अपडेट इस पृष्ठभूमि में आ रहा है कि XPeng भौतिक एआई पर ध्यान केंद्रित कर रहा है। हाल ही में, उसके रोबोटिक्स व्यवसाय ने $900 मिलियन से अधिक के पहले निजी फंडिंग राउंड को $6.3 बिलियन से अधिक के मूल्यांकन पर बंद किया - यह चीन में एम्बोडेड इंटेलिजेंस क्षेत्र में एक राउंड के लिए रिकॉर्ड है। निवेशकों में IDG, Gaorong, Tencent और Alibaba शामिल थे।

XPeng के लिए अंतिम लक्ष्य एक एकीकृत भौतिक दुनिया मॉडल बनाना है जो ड्राइविंग, रोबोट और केबिन इंटेलिजेंस को समय को ध्यान में रखते हुए एक सतत तर्क समस्या के रूप में देखता है, न कि अलग-अलग अलग समस्याओं के रूप में। समय को मॉडल में शामिल करके, कंपनी इस बात पर दांव लगा रही है कि स्वायत्तता का अगला चरण केवल धारणा जैसा कम और विकास की प्रक्रिया में दुनिया की समझ जैसा अधिक होगा।

लोकप्रिय