Xitoy kompaniyasi Z.ai juma kuni (14-sida) oʻzining GLM-5.3 sunʼiy intellekt modelining dasturiy taʼminotdagi zaifliklarni aniqlashga qaratilgan testda Anthropicning Mythos 5 modeliga nisbatan biroz yuqori koʻrsatkichlar koʻrsatganini eʼlon qildi. Bu natija xitoy texnologiyasini kiberxavfsizlik sohasidagi murakkab vazifalarni bajarishga qodir boʻlgan sunʼiy intellekt tizimlari qatoriga qoʻyadi.
Kodni tahlil qilish, xatoliklarni topish va ularning ekspluatatsiya qilinishini tasdiqlashni oʻlchaydigan CyberGym bahosi doirasida GLM-5.3 84,5% ga erishdi, Mythos 5 esa 83,8% ni koʻrsatdi. Biroq, bu raqamlar faqat Z.ai tomonidan eʼlon qilingan va hali mustaqil tekshirilmagan.
Xitoy modelining ustunligi amaliy hujumlar oʻtkazishga yaqinroq bosqichda yoʻqoldi. ExploitBench testida Z.ai modeli 54,4% olgan boʻlsa, Anthropic tizimi 78% ga yetib, Mythos 5 aniqlangan zaifliklarni haqiqiy exploitlarga aylantirish talab qilinganda sezilarli ustunlikni saqlab qolayotganini koʻrsatdi.
Z.ai GLM-5.3 ni taxminan ikki hafta ichida keng jamoatchilik uchun mavjud qilishni rejalashtirmoqda. Bu vaqtdan oldin kompaniya xavfsizlik baholarini yakunlash va zararli foydalanishni oldini olish uchun moʻljallangan mexanizmlarni yaxshilashni taʼkidlamoqda. Eng sezgir funksiyalar dastlab ishonchli kirish dasturi orqali tasdiqlangan foydalanuvchilarga cheklangan boʻladi.
Bu strategiya kompaniya ochiq tarqatmoqchi boʻlgan model uchun sezilarli oʻzgarishni tashkil etadi. Asosiy xavotir shundaki, zaifliklarni topa oladigan tizimlar ham hujumlarga yordam berishi mumkin, ayniqsa ularning ogʻirliklari yuklanishi, oʻzgartirilishi va boshqa vositalar bilan bogʻlanishi mumkin boʻlsa.
Kompaniya ushbu xatarni kamaytirish uchun turli toʻsiqlarni ishlab chiqqanini taʼkidlaydi. Ulardan potentsial xavfli soʻrovlar uchun filtrlash, model faoliyatini kuzatish mexanizmlari va tizim zararli deb hisoblangan soʻrovlardan bosh tortish uchun maxsus oʻqitish kiradi.
Z.ai maʼlumotlariga koʻra, bu himoya choralari hujumiy harakatlarni muammolarni bartaraf etish, raqamli xavfsizlikni oʻrganish va tizimlarni avtorizatsiya qilingan tekshirish kabi qonuniy qoʻllanilishlardan ajratishga qaratilgan. Tanqidchilar bu nazoratning bir qismi model erkin tarqalib, uchinchi tomonlar tomonidan oʻzgartirilishi mumkin boʻlgandan soʻng samaradorligini yoʻqotishi mumkinligini koʻrsatadilar.
Modellarning ochiqligi haqidagi xavotirlar kompaniya tomonidan cheklangan kirish davrini belgilash uchun keltirilgan sabablardan biri boʻldi. Dastlabki ishga tushirish tanlangan hamkorlar guruhiga moʻljallanadi, keyin esa Z.ai asta-sekin va masʼuliyatli deb taʼriflaydigan jarayon asosida kengaytiriladi.
Concordia AI ning sunʼiy intellekt boshqaruvi boʻyicha tadqiqotchisi Gabriel Wagner bu yechimning Xitoyning xavfsizlik modellari uchun ochiq ssenariysiga ahamiyatli ekanligini baholadi. Uning fikricha, xavfsizlik sabablari bilan ishga tushirishni kechiktirish sunʼiy intellekt tizimlarining ogʻirliklarini tarqatish bilan bogʻliq xatarlarni boshqarish amaliyotlarining yetukligining belgisi hisoblanadi.
Bu strategiya shuningdek, Mythos 5 ga faqat oldindan baholangan tashkilotlarga kirishni cheklaydigan Anthropicning Project Glasswing loyihasi bilan parallellikni yaratadi. Biroq, xitoy holatida Z.ai modelning ochiqligini tijoriy yoki xavfsizlik zaifligi sifatida emas, balki taklifining markaziy qismi sifatida taqdim etishga harakat qilmoqda.
Z.ai ilgʻor raqamli himoya tizimlari bir nechta yopiq modellarni yetkazib beruvchilarda jamlanmasligi kerakligini taʼkidlaydi. Kompaniya ochiq loyihalar ishlab chiquvchilari va kichik xavfsizlik jamoalari ham bunday resurslardan foydalanish imkoniyatiga ega boʻlishi kerak degan fikrni himoya qiladi.
Ushbu taklif doirasida kompaniya Open Source Shield — maʼlum bir ochiq kodli loyihalarni baholash, modeldan himoya maqsadlarida foydalanish imkoniyatini berish va ZCode, dasturlashga yoʻnaltirilgan mahsuloti ichiga kodni audit qilish funksiyalarini kiritishga qaratilgan tashabbusni eʼlon qildi.
GLM-5.3 ning ishlash samaradorligi yanada uzoqroq muddatni talab qiladigan vazifalarda ham tahlil qilinishi kerak. Z.ai alohida bahoda tizim ikki soat ichida 105 ta hujum yaratish vazifasini va olti soat ichida 130 ta vazifani bajarganini maʼlum qildi. Mythos 5 shu vaqt oraligʻida 181 va 247 ta vazifani bajardi.
Anthropic Mythosga nisbatan yanada cheklovchi strategiyani qabul qildi. Kompaniya oldindan baholangan tashkilotlar uchun faqatgina Claude Fable 5 asosidagi, kiberxavfsizlik funksiyalari uzoqlashtirilgan tizimni chiqarib berdi.
GLM-5.3 faqat xavfsizlik vositasi sifatida yaratilmagan. Z.ai uni kiberxavfsizlik sohasidagi faoliyatini kengaytirish uchun qoʻshimcha oʻqitish va kuchaytirilgan oʻqitishdan oʻtgan umumiy dasturlash modeli sifatida taqdim etadi. Kompaniya GLM-5.2 bilan bir xil bazadan boshlaganini va oʻqitishni yanada keng va xilma-xil vazifa muhitlari yordamida kengaytirishni taʼkidlaydi.
Bu qadam turli mamlakatlardagi ishlab chiquvchilar orasida GLM-5.2 ning mashhurligi ortganidan soʻng sodir boʻldi. Oldingi model dasturlash va agent sifatida ishlash qobiliyati tufayli mashhur boʻlgan, foydalanuvchilar va tahlilchilar uning samaradorligini AQShning ilgʻor tizimlariga yaqin, ammo ancha kam narxda ekanligini taʼkidladilar.
Raqobat boshqa xitoy kompaniyalarini ham oʻz ichiga oladi. Iyun oyida kiberxavfsizlik kompaniyasi 360 oʻzining Tulongfeng tizimi Mythosning ekvivalent qobiliyatiga sunʼiy intellekt modellarini, xavfsizlik maʼlumotlarini va avtomatlashtirilgan vositalarni birlashtirish orqali erishganini eʼlon qildi. Bu bayonot, Z.ai tomonidan GLM-5.3 haqida taqdim etilgan raqamlar kabi, mustaqil tasdiqlanmadi.
Oʻtgan oyda Hugging Face GLM-5.2 dan OpenAI sunʼiy intellekt agenti tomonidan keltirilgan singulariyaga qarshi himoya qilish uchun foydalanganini maʼlum qildi. Ushbu hodisa xitoy modellaridan himoya operatsiyalarida foydalanishga boʻlgan qiziqishni oshirdi va texnologiya allaqachon real xavfsizlik ssenariylarida qoʻllanilganini koʻrsatdi.