Zhipu anonim "Niu Lai" modelining GLM-5.3-Flash ekanligini va u 100 000 mahalliy chiplar ustida ishlayotganini tasdiqladi
Batafsil
Pandaily
pandaily.com

Zhipu anonim "Niu Lai" modelining GLM-5.3-Flash ekanligini va u 100 000 mahalliy chiplar ustida ishlayotganini tasdiqladi

Zhipu AI kompaniyasi anonim Ox Alpha modeli, xitoy ishlab chiquvchilar doiralarida "Niu Lai" deb tanilgani, yangi chiqarilgan GLM-5.3-Flash modeliga teng ekanligini rasman eʼlon qildi. Rasmiy ishga tushishidan oldin model OpenRouter va OpenCode platformalarida anonim sinov uchun bepul taqdim etilgan. Besh kun davomida sinov 50 trilliondan ortiq token trafikni jalb qilib, ikkala maydonda ham oʻsish rekordlarini qoʻygan. Shu bilan birga, ushbu modeldan foydalanish DeepSeek koʻrsatkichlaridan ikki baravar ortiq boʻldi.

Bozorning diqqatini Zhipu tomonidan qoʻshimcha aniqlik tortdi: barcha bu trafik mahalliy chiplar yordamida xizmat koʻrsatilgan. Kompaniya texnik hujjatlarida oʻz inferensiya xizmati 100 000 dan ortiq mahalliy chiplardan iborat klasterda ishlayotganini koʻrsatgan. Zhipu shuni taʼkidladiki, "uskunaning samaradorligi va bitta token narxi asosiy Nvidia grafik protsessorlari darajasiga yetib keldi".

Yarimkonduktorlar sohasidagi tadqiqot firmasi SemiAnalysis Xʼda izoh berib, har bir soʻrovni Nvidia bilan taqqoslanadigan samaradorlikda mahalliy kremniy yordamida xizmat koʻrsatish "CUDA dengizini yana bir bor sinovdan oʻtkazmoqda", ayniqsa OpenAI Jalapeño uchun oʻz inferensiya chipini eʼlon qilganidan keyin. LatePost bu chiplar Huawei, Moore Threads va Hygon tomonidan ishlab chiqarilishi mumkinligini maʼlum qildi, ammo Zhipu yetkazib beruvchilar yoki aniq modellar haqida tasdiqlashdan bosh tortdi.

Bir million tokenli kontekst oynasigacha kengaytirish uchun Zhipu SGLang asosida maxsus inferensiya dvigatelini ishlab chiqdi. Ushbu dvigatel W8A8 kvantizatsiyasidan, INT8/FP8/BF16 aralash kesh kvantizatsiyasidan va tugun darajasidagi tensor parallelizmidan foydalanadi. Bundan tashqari, kodlash, promptni oldindan qayta ishlash va tokenni token boʻyicha dekodlashni ajratuvchi arxitektura joriy etildi, bu turli xil pulldagi mustaqil rejalashtirish imkonini beradi.

Kompaniya toʻliq xizmat samaradorligi dastlabki bazaviy chiziqqa nisbatan uch barobar yaxshilanganini daʼvo qiladi. GLM-5.3-Flash modeli 320 milliard umumiy parametrga ega, bunda 18 milliard faollashtirilgan, bu taxminan DeepSeek V4 Flash ga mos keladi. U Sunʼiy intellekt tahlili indeksi boʻyicha 57 ball oladi, bu Claude Opus 4.8 ga teng va DeepSeek V4 Pro dan ustun. Model narxi GLM-5.3 narxining bir ondi va Claude Opus 4.8 narxining bir yuzdan bir qismi atrofida boʻlib, bu uni xitoy modellari narxlari umumiy oshishi fonida qulay variantga aylantiradi.

Oʻxshash hikoyalar

OpenAI oʻzining Jalapeno chipi Nvidia mahsulotlaridan dastlabki sinovlarda ustun ekanligini taʼkidladi
Batafsil
ventureburn.com

OpenAI oʻzining Jalapeno chipi Nvidia mahsulotlaridan dastlabki sinovlarda ustun ekanligini taʼkidladi

OpenAI oʻzining yangi ishlab chiqilgan ichki sunʼiy intellekt protsessori Jalapeno nomli kod ostida joriy Nvidia Corp. mahsulotlari liniyasiga qaraganda yaxshiroq natijalar koʻrsatganini batafsil ichki va jamoatchilik sinovlari davomida maʼlum qildi. Bu yutuq ChatGPT ishlab chiquvchisi tomonidan mustaqil AI infratuzilmasini yaratish va oʻsib borayotgan operatsion xarajatlarni kamaytirishga intilishini taʼkidlaydi.

OpenAI chiplar boʻlimi rahbari Richard Ho soʻzlariga koʻra, Jalapeno protsessori benchmarklarda ikkita asosiy parametr boʻyicha Nvidia GB300 chiplaridan oldinda turdi: birlik quvvatga AI yukini qayta ishlash hajmi va javoblar berish tezligi. Broadcom Inc. chip ishlab chiqaruvchisi bilan hamkorlikda yaratilgan bu maxsus yarimoʻtkazgich past kuchlanishda, 700 vattda samarali ishlaydi, yuqori tranzit quvvati va past kechikishni taʼminlaydi.

Koʻpgina apparat yechimlari faqat ogʻir vazifalarni qayta ishlash yoki tezkor reaksiyaga javob berishga ixtisoslashgan boʻlmagan aksiga, Jalapeno ikkala sohada ham kuchli koʻrsatkichlarni namoyish etadi. Chip ochiq kodli kichik modellar, shuningdek, DeepSeek va Moonshot AI ning uchinchi tomon modellaridan foydalangan holda jamoatchilik sinovlaridan oʻtgan va Moonshot ning Kimi kabi kattaroq va talabchan vazifalar bilan ishlashda afzalliklarni koʻrsatgan.

Qoʻshimcha maʼlumot

Bu yarimoʻtkazgich sunʼiy intellektning inferens bosqichi uchun maxsus moʻljallangan — bu oʻrganilgan modellar foydalanuvchilar soʻrovlariga javob beradigan operatsion bosqich, naqshatning boshlangʻich oʻquv bosqichi emas, bunda Nvidia texnologiyalari hali ham ustunlik qiladi. Energiya isteʼmoli zamonaviy maʼlumotlar bazasi markazlaridagi asosiy xarajatlardan biri boʻlgani uchun, Jalapeno ning past kuchlanishli dizayni OpenAI ning infratuzilma va operatsion xarajatlarini sezilarli darajada kamaytirish imkonini beradi.

Qoʻshimcha maʼlumot

OpenAI ushbu yangi chiplarni joriy etishni joriy yil oxirida boshlashni rejalashtirgan boʻlsa-da, rahbar Richard Ho kompaniya Nvidia ni hayotiy yetkazib beruvchi va hamkor sifatida koʻrishda davom etayotganini taʼkidladi. Chipni taqdim etish kengroq sanoat tendensiyasi — oʻziga xos uskunalarni ishlab chiqish bilan uygʻunlashadi; Etched va MatX kabi startaplar ham tranzit quvvat va kechikishni muvozanatlashtirish uchun moʻljallangan ilgʻor past quvvatli protsessorlar ustida ishlamoqda.

OpenAI oʻzining apparat ekotizimasining keyingi iteratsiyalarini ishlab chiqishni ilgari surmoqda. Ikkinchi versiya chip loyihalashtirishning kechki bosqichida ekanligi va yakuniy chiqarilishi yaqin oylarda kutilayotgani maʼlum boʻldi, shu bilan birga uchinchi avlod konsepsiyalari allaqachon ishlab chiqilmoqda. Ho bu apparat yutuqlarini Stanford universiteti Hot Chips konferensiyasida taqdim etishni nazarda tutmoqda, bu OpenAI ning kengroq apparat innovatsiyalarini ragʻbatlantirish strategiyasini taʼkidlaydi. Oʻz kremi bilan bogʻliq saʼy-harakatlar kengayayotganiga qaramay, OpenAI global miqyosda umumiy hisoblash ehtiyojlari oʻsishda davom etayotgani sababli Cerebras Systems kabi tashqi uskuna yetkazib beruvchilari bilan munosabatlarni saqlab qolishini tasdiqladi.

Xiaomi Xuanjie O3 chipini taqdim etdi, bu flagman SoC AnTuTu da 5 million balldan oshdi
Batafsil
pandaily.com

Xiaomi Xuanjie O3 chipini taqdim etdi, bu flagman SoC AnTuTu da 5 million balldan oshdi

Kompyuter texnologiyalari boʻyicha brifingda Xiaomi kompaniyasi flagman mobil tizim chipli Xuanjie O3 ni taqdim etdi. Bu chip AnTuTu benchmarkida 5,22 million ball natijasini koʻrsatib, 5 million chegarasini bosib oʻtgan birinchi flagman SoC boʻldi. Ushbu mahsulotni ishlab chiqish kompaniyaga 459 kunni oldi.

Xuanjie O3 premium qurilmalar uchun «AI flagman» SoC sifatida loyihalashtirilgan. U oʻn yadroli CPU protsessorini toʻliq katta yadrolar bilan (oltita superkatta yadro va 4 ta katta yadro, 4,35 GHz chastotagacha yetadi) va 15 000 dan ortiq boʻlgan koʻp yadroli hisoblashni birlashtiradi, bu esa samaradorlikni 60 foizga oshiradi. Grafik protsessor (GPU) uchinchi avlod nurlanish izlash bilan jihozlangan 16 yadroli G2-Ultra NX boʻlib, bu grafik samaradorlikni 85 foizga oshiradi va shu bilan birga energiya sarfini 64 foizga kamaytiradi.

Bundan tashqari, Xuanjie O3 113,8 GB/s uzatish tezligiga ega LPDDR6 xotirasini qoʻllab-quvvatlaydigan birinchi mobil protsessor boʻlib, bu Xuanjie O1 ga qaraganda 48 foiz yuqori. Neyron protsessori Xiaomi qurilmasidagi MiMo modellaridan foydalangan holda qayta qurilgan boʻlib, bu qurilmada 200 TOPS tensor hisob-kitoblari va 3,13 TFLOPS vektor hisob-kitoblarini taklif etadi, bu esa qurilmadagi AI samaradorligini taxminan 45 foizga yaxshilaydi.

Tasvirni qayta ishlash konveyeri beshinchi avlod flagman ISP ga yangilandi, u 432 megapikselgacha aniqlikdagi kamerani, 64M + 64M + 50M uch kamerali massivlarni va 24-bit rang chuqurligini qoʻllab-quvvatlaydi, shuningdek, AI yordamida 4K60FPS kechki video shovqinini bartaraf etishni taʼminlaydi. Mustaqil ishlab chiqilgan RISC-V xavfsizlik yadrosi endi Xitoyning ichki shifrlash sertifikati va CCRC EAL5+ ishonch darajasiga ega.

Xuanjie O3 barcha modullarga AI imkoniyatlarini integratsiya qiladi: CPU dagi ikkita SME2 tezlatuvchisi, GPU dagi sakkizta NX neyron tezlatuvchisi, ISP ichidagi AINR bloki, DPU dagi apparatli AI superrezolyutsiya bloki va ADSP dagi AI dvigateli. Past energiya sarfi optimallashtirishlari, jumladan, birlashtirilgan birlashma magistrali va yuqori darajadagi topologik metall joylashuvi, statik kechikishni 82 nanosekundgacha taʼminlaydi.

Bu chipni chiqarish uchta chip liniyasini yakunlaydi: O3 endi masshtabli ishlab chiqarishga oʻtmoqda, O100 va D100 esa ishlab chiqish bosqichini yakunlab, kelgusi yili tijorat bozoriga chiqarilishi rejalashtirilgan. Xuanjie O3 bilan jihozlanadigan birinchi qurilmalar sentyabr oyida kutilayotgan Xiaomi 18 Fold va Xiaomi Pad 9 Pro Max boʻladi.

Mashhur