China Mobile Cloud GPU va neyromorf chiplar asosida LLM inferensi uchun heterogen stekni taqdim etdi
Batafsil
Pandaily
pandaily.com

China Mobile Cloud GPU va neyromorf chiplar asosida LLM inferensi uchun heterogen stekni taqdim etdi

China Mobile Cloud katta til modellarini (LLM) aralash inferens uchun mahalliy gibrid tizimni taqdim etdi, u grafik protsessorlarni (GPU) va neyromorf texnologiyalarni birlashtiradi. Ushbu tizim 2026 yilda Hebei provinsiyasi, Lanfangdagi hisoblash quvvati konferensiyasida birinchi marta namoyish etildi.

Bu stekni ishlab chiqishda China Mobile Cloud, shuningdek, Xitoyning Nanhu elektronika texnologiyalari tadqiqot instituti (China Electronics Technology Nanhu Research Institute), Lynxi, Iluvatar CoreX, Tsinghua universiteti va Pekin universiteti ishtirok etdi. China Mobile Cloud ning neyromorf va optik laboratoriyasi texnik direktori Du Yujian taʼkidlaganidek, neyromorf imkoniyatlari mavjud GPU parklarini toʻliq almashtirish talab qilmasdan ularni tezlashtirishga qaratilgan.

Asosiy konsepsiya Transformerni ishning turli chip turlari oʻrtasida aniq ajratishdan iborat. Eʼtibor hisob-kitoblari Iluvatar CoreX ning mahalliy GPUlarida ularning umumiy tranzit quvvatidan foydalangan holda qoladi. Toʻgʻridan-toʻgʻri tarqatish bloklari (feed-forward network blocks), shu jumladan ekspertlar va ekspertlarni aralashtirish mexanizmi (mixture-of-experts) kabi kechikish uchun muhim boʻlgan bloklar Lynxi neyromorf kremiyasiga koʻchiriladi. Bu kremiy chip xotirada hisoblashlar va kristalda katta hajmdagi SRAM uchun optimallashtirilgan boʻlib, bu yuqori raqobatbardoshlikka ega tokenlarni xizmat qilishda bitta GPU arxitekturasidagi 'xotira devori' va 'quvvat devori' tomonidan yaratilayotgan bosimni kamaytirishga yordam beradi.

Bu ikki tuzilmani sinxronlashtirish uchun oʻzi ishlab chiqilgan model kompyutatori, yuqori tezlikdagi bogʻlanish protokoli va birlashtirilgan inferens mexanizmi qoʻllaniladi, ular vazifalarni dekompozitsiya qilish, birgalikda rejalashtirish va natijalarni agregatsiya qilish uchun javobgardir.

Test yuklamasi sifatida DeepSeek V4 Flash tanlandi. China Mobile Cloud boshqa mahalliy GPU klasterlariga qaraganda, ushbu gibrid stek inferens chiqishini va energiya samaradorligini ikki barobar oshiradi hamda biznes operatsion xarajatlarini 40% dan ortiq kamaytiradi deb daʼvo qiladi. Hamkorlar bu koʻrsatkichlarni yetuk mahalliy jarayonlar asosidagi arxitektura, tizim dasturiy taʼminoti va yuklamalarni joylashtirishga urgʻu berib, nafaqat jarayonlar va tugunlar yaroshiqiga bogʻliq boʻlishini tushuntiradilar. Ular shuningdek, bu modelni mahalliy GPUlardan foydalanayotgan boshqa operatorlar ham takrorlashi mumkin deb hisoblashadi.

Konferensiya materiallari shuni koʻrsatadiki, PD va Attention-FFN ajratilishining keyingi joriy etilishi maqsadlari token fabrikalari, AI kodlash, matndan videoga aylantirish, koʻp agentli oʻzaro aloqa, aqlli ishlab chiqarish, shuningdek, moliyaviy va kommunikatsiya xavfsizligi boʻladi.

Konsorsium heterogen dvigatelni takomillashtirish va asosiy freymvorkning qismlarini mahalliy GPU, neyromorf chiplar va hisoblash operatorlari ishlab chiqaruvchilari uchun asta-sekin ochish rejasini eʼlon qildi. Tokenning narxiga yoʻnaltirilgan bulut xizmatlari sotuvchilari uchun bu debiut bitta akseleratorning toj kiyishi emas, balki Attention-on-GPU + MoE FFN-on-neuromorphic rejalashtirish trafik konferensiya standidan chiqqandan soʻng kechikish, chiqish va foydalanishni qoʻllab-quvvatlay olishi tekshiruvi hisoblanadi. Ishga tushirish paytida hamkorlarning DeepSeek V4 Flash sozlamalaridan tashqari uchinchi tomon klasterlari uchun mustaqil benchmarklar chop etilmadi; bu maʼlumotlar paydo boʻlguncha hisoblash quvvati konferensiyasidagi debiut asosan tayyor SKU sigʻimi emas, balki dasturiy taʼminot va kremiyaning qayta tiklanadigan retseptini hujjatlashtiradi.

Oʻxshash hikoyalar

Toʻrtta xitoy grafik protsessor ishlab chiqaruvchisi differensiallashish bosqichiga oʻtmoqda
Batafsil
pandaily.com

Toʻrtta xitoy grafik protsessor ishlab chiqaruvchisi differensiallashish bosqichiga oʻtmoqda

Xitoyning toʻrtta mahalliy grafik protsessor ishlab chiqaruvchisi — Moore Threads, Biren Technology, Enflame va MetaX — jamoatchilik bozorlariga chiqqan yoki yaqinlashib kelyapti va endi ular differensiallashish bosqichiga kirishmoqda. Tahlilchilar eslatadiki, asosiy savol chip mavjudligidan kompaniya toʻliq tijorat siklini shakllantirish qobiliyatiga oʻtdi.

Bu kompaniyalar zararlarni kamaytirish bilan birga tez oʻsishni namoyish etmoqda. Birinchi bozorga chiqqan Moore Threads daromad boʻyicha yetakchi hisoblanadi va umumiy bozorda barqaror seriya yetkazib berishni boshladi. Biren va Enflame sunʼiy intellekt uchun katta klasterlar tenderlariga eʼtibor qaratmoqda, bu esa yuqori, ammo beqaror talab bilan tavsiflanadi, shu bois MetaX yanada barqaror oʻsishni koʻrsatmoqda.

Toʻrtta kompaniya ham CUDA ekotizimining NVIDIA tomonidan egallangan bozor ulushini olish uchun haqiqiy jang maydoni deb tahlilchilar deb hisoblayotgan dasturiy taʼminotga faol sarmoya kiritmoqda.

Toʻrtta kompaniya ikki texnik lagerga ajraldi. Moore Threads, Biren va MetaX universal grafik protsessor yoʻliga amal qiladi, ishlab chiquvchilarni almashtirish xarajatlarini kamaytirish uchun CUDA bilan yuqori moslikni saqlab qoladi. Moore Threads ning oʻziga xos MUSA arxitekturasi 800 000 dan ortiq ishlab chiquvchini jalb qildi. Enflame istisno hisoblanadi, chunki u CUDA ni taqlidlamaydigan ajratilgan arxitektura (DSA) dan foydalanadi va drayverlar, kompilyatorlar va operator kutubxonalarini oʻz ichiga olgan tops Rider oʻzining stekida qoʻllab-quvvatlanadi.

Mijozlar bilan ishlash strategiyasi ham farq qiladi. Enflame Tencent bilan yaqindan bogʻlangan, kompaniya buni bir vaqtning oʻzida himoya toʻsiq va cheklov deb atagan, chunki Tencent uning daromadining sezilarli qismini sotib olgan. Biren mijozlar bazasi milliy hisoblash markazlari, uchta davlat telekommunikatsiya operatorlari va yetakchi AI laboratoriyalarini qamrab oladi. Moore Threads mahsulotlarini internet, telekommunikatsiya va davlat boshqaruvi sektorlarida keng sotadi.

Faollikka qaramay, bu toʻrtta kompaniya Xitoydagi AI akseleratorlari bozorida hali kichik qismni tashkil etadi. IDC baholariga koʻra, 2025 yilda Xitoyda taxminan toʻrtta million AI akselerator kartasi joʻnatilgan, bunda NVIDIA taxminan 55 foizni, Huawei esa ichki hajmining deyarli yarmini taʼminlagan. Konsalting kompaniyasi CIC 2028 yilga kelib Xitoydagi AI akseleratorlari bozori bir trillion yuan dan oshib ketishini prognoz qilmoqda, bunda mahalliy yechimlarning ulushi taxminan 90 foizga yetishi kutilmoqda. Keyingi ikki yil ichida bu toʻrtta kompaniya birdaniga inqirozga duch kelish oʻrniga, oʻquv, inferens va renderlash sohalarida tabiiy darajalarga erishishi kutilmoqda.

Mashhur