Zhipu AI ning GLM-5.3-Flash modeli 100 000 mahalliy chiplar ustida ishlaydi va OpenRouterda foydalanish boʻyicha yetakchilik qilmoqda
Batafsil
Pandaily
pandaily.com

Zhipu AI ning GLM-5.3-Flash modeli 100 000 mahalliy chiplar ustida ishlaydi va OpenRouterda foydalanish boʻyicha yetakchilik qilmoqda

Zhipu AI kompaniyasi GLM-5.3-Flash modelini taqdim etdi, bu model kompaniya taʼkidlashicha, faqat ichki sunʼiy intellekt chiplari ustida ishlaydi. Barcha onlayn trafikni qayta ishlash uchun 100 000 mahalliy ishlab chiqarilgan tezlatgichlardan foydalaniladi.

Model tahliliy firma Artificial Analysis ning AAII reytingida DeepSeekʼs V4 Pro Max ni ortda qoldirib, oʻninchi oʻringa kirishdi. Zhipu AI GLM-5.3-Flash ga keladigan barcha soʻrovlar ushbu 100 000 ta mamlakat ichida ishlab chiqarilgan chiplar tomonidan xizmat koʻrsatilayotganini taʼkidladi.

GLM-5.3-Flash dastlab 20 avgustda «Ox Alpha» kodli nom ostida chiqarilgan va bir hafta ichida OpenRouter AI modellarini yoʻnaltirish platformasida mashhurlik roʻyxatlarining boshiga chiqdi. Kompaniya bu modelni yuqori samarali, Xitoyning ichki hisoblash infratuzilmasi miqyosida ishlash uchun yetarli darajada samarali deb taqdim etadi.

Zhipu AI qaysi chip yetkazib beruvchisi ishlatilganini jamoatchilikka oshkor qilmagan. Biroq, CNBC xabarlariga koʻra, tahlilchilar uskunaning Huawei ning Ascend seriyasiga tegishli ekanligini taxmin qilishmoqdalar. Tadqiqot firmasi Counterpoint tahlilchisi Ivan Lin shuni taʼkidladi,ki, Xitoy AI modellarini ishlab chiquvchilari tobora koʻproq investitsiyalarni mahalliy chiplar asosidagi AI serverlari va hisoblash infratuzilmasiga yoʻnaltirmoqda.

Bu ishga tushirish Xitoydagi kamida bitta yetakchi model ishlab chiqish laboratoriyasi ichki taʼminot zanjiri flagman yuklamalarni qoʻllab-quvvatlashga tayyor deb hisoblayotgani haqida eng aniq signaldir. Zhipu AI hisoblash quvvatlarini kengaytirishda «Xitoy singoblarining» eng faollari qatoriga kiradi va «frontir» sinfidagi modelni oʻz tezlatgichlari ustida kundalik ishlatish samaradorlik va chip mavjudligi haqida bayonotdir.

Bu qadam sanoatdagi kengroq tendensiyaga ham mos keladi. Eksport nazorati cheklovlari xorijiy ilgʻor chiplarga kirishni cheklab qoʻyganligi sababli, Xitoy modellarining yaratuvchilari oʻzlarining haqiqatda sotib olishi mumkin boʻlgan uskunaga dasturiy taʼminotni optimallashtirishga shoshilyapti. Mahalliy chiplar ustida ishlayotganda benchmarklarda yuqori natijalar koʻrsatadigan model, dasturiy taʼminot samaradorligi apparat taʼminoti boʻshliqlarini qoplashi mumkinligining dalilidir.

Zhipu AI uchun Flash liniyasi model sifati va amaliy miqyosdagi moslashuvchanlikni birlashtirish strategiyasini ifodalaydi. 100 000 ta chipni qoʻllab-quvvatlash orqali GLM-5.3-Flash Xitoydagi laboratoriya import importlangan tezlatgichlarga bogʻliq boʻlmasdan raqobatbardosh «frontir» darajasidagi samaradorlikni taʼminlashga qodir ekanligini namoyish etishi kerak.

Oʻxshash hikoyalar

Maʼlumotlar modellarining 'Flash' versiyalari Xitoyda LLM ning flagman segmentini oʻzgartirmoqda: mavjudlik yuqori samaradorlikdan ustun turadi
Batafsil
pandaily.com

Maʼlumotlar modellarining 'Flash' versiyalari Xitoyda LLM ning flagman segmentini oʻzgartirmoqda: mavjudlik yuqori samaradorlikdan ustun turadi

Xitoydagi katta til modellarining (LLM) flagman liniyasi deyarli bir zumda sezilarli oʻzgarishlarga uchradi. Zhipu AI GLM-5.3-Flash modelining manbasini chiqarib, uni ochiq kod sifatida taqdim etdi. Bu model avgust oyidan boshlab OpenRouterda birinchi oʻrinni egallagan anonim ishtirokchi edi. Shu bilan birga, Alibaba Qwen3.8-Flash ni taqdim etib, uning vaznlarini Hugging Face va ModelScope jamoatchiligida joylashtirdi.

Ikkala model ham 'Flash' seriyasiga tegishli va agressiv narx siyosatini qoʻllaydi, bu yuqori samaradorlik har doim yuqori narx degani boʻlgan anʼanaviy tushunchani inkor etadi. GLM-5.3-Flash modeli bir million token atrofidagi kontekst oynasini qoʻllab-quvvatlaydi va GLM-5 oilasida birinchi marta tabiiy ravishda multimodal boʻlgan model hisoblanadi. U tasvir, video, fayllar va hatto kompyuterdan foydalanishni qayta ishlash qobiliyatiga ega.

Cheklangan chegirma davrida GLM-5.3-Flash uchun kirish narxi million token uchun 0,4 yuan, chiqish narxi esa 1,4 yuan tashkil etadi. Bu GLM-5.3 ga nisbatan taxminan yigirma barobar arzonroq. Qwen4 arxitekturasining dastlabki koʻrinishi sifatida taqdim etilgan Qwen3.8-Flash ham millionlik kontekst oynasini saqlab qoladi. Million kirish tokeni uchun 1 yuan va chiqish uchun 3 yuan narxda u Qwen3.8-Max dan taxminan oʻn ikki barobar arzonroq boʻlib, ofis ishlar senariylarida token isteʼmolini 75% ga kamaytiradi.

Bu tezkor va taqqoslashdagi chiqarilishlar DeepSeek ustiga bosim oʻtkazmoqda, chunki u uzoq vaqtdan beri Xitoyda narx-samaradorlik mezonini belgilab kelgan. DeepSeek V4 Flash ning joriy narxi million token uchun kirish uchun 1,5 yuan va chiqish uchun 4,5 yuanni tashkil etadi, bu eng yuqish va past yuklamalar koeffitsientlarini oʻz ichiga oladi. Sinov taqqoslashlarida GLM-5.3-Flash Opus sinfidagi modellarga yaqin natijalar koʻrsatdi — bu 'Flash' erishishga intilayotgan darajadir. Ushbu modelning anonim ishga tushirilishi DeepSeek ning OpenCodeʼdagi 56 kunlik ustunligini yakunladi. Zhipu maʼlumot berishicha, trafik 100 000 dan ortiq mahalliy AI chiplari orqali xizmat koʻrsatilgan boʻlib, ularning samaradorligi NVIDIA ning asosiy GPUlari bilan teng keladi deb daʼvo qilinadi.

Chuqurroq signal strategik siljishda yotadi: 'Flash' atamasi shunchaki qisqartirilgan variantni anglatmaydi. Endi ishlab chiquvchilar bu modellarini katta kontekst, multimodal kiritish, raqobatbardosh fikrlash va ularni kod agentlari va ofis paketlaridagi kundalik ishlab chiqarish vazifalari uchun standart tanlov qiladigan narx tufayli haqiqiy flagmanlar sifatida joylashtirishmoqda.

Natijada, narxga bogʻliqlik tezda parchalanadigan bozor shakllanmoqda. Model yetkazib beruvchilari endi faqat maksimal samaradorlik boʻyicha raqobatlashmaydi, balki aksariyat ishlab chiquvchilar hech qachon 'Proʻ darajasiga murojaat qilmasligi uchun yetarlicha past narxda amaliy ish yuklarini taqdim etishga eʼtibor qaratmoqda. Xitoy LLM bozorida mavjudlik va kenglik sekin-asta flagman darajasining yangi standarti boʻlib qoldi.

Zhipu AI GLM-5.3-Flash nomli modelni taqdim etdi, bu model avval 'Ox Alpha' deb tanilgan
Batafsil
pandaily.com

Zhipu AI GLM-5.3-Flash nomli modelni taqdim etdi, bu model avval 'Ox Alpha' deb tanilgan

Dunyoning sunʼiy intellekt ishlab chiquvchilari bir necha kun davomida Ox Alpha modeli kimligini aniqlashga harakat qilishdi — bu kutilmaganda OpenRouter platformasida ishlab chiquvchi, parametrlar yoki texnik hisobot koʻrsatilmagan sirli mahsulot edi. Bu model kod yaratish, murakkab fikrlash va uzoq agent vazifalarini bajarishdagi qobiliyatlari tufayli platforma trendlar roʻyxatida tezda yuqoriga koʻtarildi.

Oʻtgan hafta sirlar oshkor boʻldi: Ox Alpha Zhipu AI ning eng yangi chiqarilishi — GLM-5.3-Flash modeli ekanligi maʼlum boʻldi. Model dastlab 20-avgustda OpenRouterda anonim ravishda amaliy koʻz yopib sinovlar doirasida joylashtirildi. Ushbu davr mobaynida uning provayderi kundalik xizmat koʻrsatish quvvati boʻyicha taxminan 100 trillion tokenni bepul taqdim etdi, bu esa koʻplab haqiqiy foydalanuvchilarni jalb qildi. Stripe hamjamiyat aʼzosi Patrick Collison buni 'juda taʼsirli' deb atadi. Muhim jihati shundaki, Zhipu anonim ishga tushirish paytida hosil boʻlgan barcha trafik mahalliy AI chiplari ustida joylashtirilgan katta klaster orqali xizmat koʻrsatilganini bildirgan.

GLM-5.3-Flash 320 milliard umumiy parametrga ega 'ekspertlar aralashmasi' (mixture-of-experts) turidagi model boʻlib, bunda har bir inferens bosqichida faqat taxminan 18 milliard faol qoʻllaniladi. Bu 320 milliard umumiy va 32 milliard faol parametrga ega GLM-4.5 seriyasidan farq qiladi va qatlamlar soni 92 dan 45 ga kamaytirilgan. Nomi ichidagi 'Flash' prefiksi flagman darajasidagi samaradorlikka yaqin saqlanishni taʼminlaydigan, shu bilan birga har bir token uchun hisoblash yukini kamaytiradigan arxitekturani bildiradi.

Bundan tashqari, bu GLM-5 oilasidagi birinchi tabiiy multimodal model boʻlib, kontekst oynasi hajmi taxminan bir million token boʻlgan matn, tasvir, video va fayllarni qabul qila oladi. U 30 trillion tokenli multimodal korpus asosida oʻqitilgan. Bir million tokenda inferensni mavjud qilish uchun Zhipu chiziqli diqqatni (linear attention) sekinlashgan diqqat (sparse attention) bilan birlashtirdi — kompaniya buni bunday ochiq ilgʻor modeldagi birinchi gibrid arxitektura deb ataydi, shuningdek, indeksatorning qoʻshimcha yukini kamaytirish uchun IndexPool ni qoʻshdi. Kompaniya diqqatning hisoblash yukining taxminan uchdan bir qismi, KV keshining esa taxminan chorak qismini kamaytiradi deb baholaydi, bu GLM-5.3 ga nisbatandir.

Testlar modelning kod va agent vazifalari bilan ishlashdagi kuchli tomonlarini koʻrsatadi: u DeepSWE v1.1 da GLM-5.2 ning 46.2 balliga qarshi 63.4 ball, AutomationBench da 26.2 ga qarshi 48.8 ball va Terminal-Bench 2.1 da 84.3 ball olgan. Model vaznlari endi Hugging Face da MIT litsenziyasi ostida mavjud boʻlib, SGLang, vLLM va bogʻliq freymvorklar orqali mahalliy joylashtirishni qoʻllab-quvvatlaydi. Ishga tushirish paytida maʼlumotlarni oshkor qilmaslik orqali Zhipu ishlab chiquvchilarga faqat modelning faktik samaradorligiga asoslangan holda hukm chiqarish imkonini berdi.

OpenAI Nvidia bilan raqobatlashish uchun oʻzining Jalapeño AI-chiplarini ishlab chiqardi
Batafsil
www.aajtak.in

OpenAI Nvidia bilan raqobatlashish uchun oʻzining Jalapeño AI-chiplarini ishlab chiqardi

ChatGPT yaratuvchisi boʻlgan OpenAI kompaniyasi Jalapeño nomli oʻzining sunʼiy intellekt chiplarini ishlab chiqaryapti. Kompaniya bu birinchi AI-chip AI modellarining ish tezligini oshirib, energiya sarfini kamaytiradi deb taʼkidlaydi.

Bu qadam juda muhim boʻlishi kutilmoqda, chunki u sunʼiy intellektni qoʻllab-quvvatlashni yaxshilashga va kompaniyaning Nvidia ga bogʻliqligini kamaytirishga yordam beradi. ChatGPT allaqachon chat-bot sifatida mashhur boʻlsa-da, endi kompaniya AI modellarining ishlaydigan qurilmalarini loyihalashtirish orqali apparat taʼminotiga yoʻnaltirilmoqchi.

Broadcom bilan hamkorlik

Jalapeño AI modellarining ishlashi uchun maxsus ishlab chiqilgan maxsus (custom) chipdir. Kompaniya uni Broadcom bilan hamkorlikda tayyorladi.

Energiya samaradorligiga urgʻu berilgan dizayn

OpenAI chip past energiya sarfi va minimal javob berish vaqtida yuqori samaradorlikni namoyish etishi uchun loyihalashtirilganini maʼlum qildi. Kompaniya uni GPT-OSS 120B, Deepseek R1 va Kimi K2.5 1T kabi bir qator tanlangan AI modellarida sinovdan oʻtkazdi.

OpenAI bayonotlariga koʻra, Jalapeno chiplasti AI apparat taʼminoti sohasidagi jiddiy muammolardan birini hal qildi — kechikishni oshirmasdan yuqori samaradorlikka erishish. Jalapeno chiplasti aynan inferens jarayoni uchun yaratilgan. Inferens deganda, oʻrgatilgan AI modeli foydalanuvchi soʻrovini qayta ishlashi va javob shakllantirishi tushuniladi, masalan, foydalanuvchi ChatGPT ga savol berganida.

Kompaniyaning maqsadi chipli, dasturiy taʼminot, xotira, tarmoq infratuzilmasi va xizmat koʻrsatish tizimini oʻz modellariga moslashtirish orqali toʻliq samaradorlik va mahsuldorlikni taʼminlashdir.

Mashhur