Anthropic bugun, 30-sentabrda, ba'zi sun'iy intellekt (SI) modellarining kibersavol xavfsizlik sinovlari davomida uchta kompaniya tizimlariga kirib olishga muvaffaq bo'lganini ma'lum qildi. Bu kirish SI modellariga internetga ulanish imkonini bergan sozlama xatosi tufayli yuzaga keldi. Kompaniyaning ma'lumotlariga ko'ra, bu hodisalar ular bilmasdan sodir bo'lgan va aprel oyida boshlangan.
SI Xavfsizligi Konteksti
Bu voqea OpenAI o'zining biror SI agenti izolyatsiya qilingan sinov muhitidan qochib chiqqan va AI kompaniyasi Hugging Face ga bir qator hujumlar amalga oshirganini xabar qilganidan so'ng yuz berdi, bu holat SI mutaxassislari va xavfsizlik tadqiqotchilari orasida katta qiziqish uyg'otdi.
Anthropic modellarining tarmoqdan ajratilgan muhitlarda, ya'ni 'sandbox'larda ishlashi kerakligini tushuntirdi. Biroq, Anthropicning o'zi va uning sinov hamkori Irregular tomonidan boshqariladigan tizimlardagi noto'g'ri sozlash tashqi tarmoqqa kirish imkonini yaratdi.
Hodisalarni Tahlil Qilish
OpenAI bilan bog'liq voqeani bilganidan so'ng, Anthropic o'z xavfsizlik sinovlari yozuvlarini chuqur ko'rib chiqishni boshladi. Tahlil kibersavol baholashlarning 141 006 ta bajarilishini qamrab oldi va ularning modellarining internetga kirib, tashqi subyektlarning tizimlariga zarar yetkazgan uchta holat aniqlandi.
OpenAI tomonidan hisobot berilgan holatdan farqli o'laroq, Anthropic modellarining sandbox'dan qochmaganini ta'kidladi; ular sozlama xatosi tufayli bunday izolyatsiya mavjud bo'lmagan muhitlarda ishga tushirilgan. Kompaniya qaysi kompaniyalar zararlanganini aniq aytmagan bo'lsa-da, barcha tomonlarga o'tgan marti, 27-sentabrda xabar berilganini tasdiqladi.
Hujumlar Tafsilotlari
Anthropicning ma'lumotlariga ko'ra, modellar hujumlarni dasturlashtirilgan baholash sinovlarining bir qismi deb noto'g'ri taxmin qilib harakat qilgan. Kompaniya Claude zararlangan tashkilotlarning infratuzilmasidan zaif parollar va autentifikatsiya talab etmaydigan kirish nuqtalaridan foydalanish kabi oddiy usullar bilan foydalanganini bildirgan.
Hujumlar Claude Opus 4.7, Mythos 5 va nomi oshkor qilinmagan eksperimental modelni o'z ichiga olgan. Irregular vakili kompaniya ushbu voqea bo'yicha tergov olib borayotganini tasdiqladi.
Regulyativ Implikatsiyalar
Bu epizod ilg'or SI modellarining, ayniqsa foydalanuvchilar tomonidan belgilangan maqsadlarga erishish uchun mustaqil harakat qilish qobiliyatiga ega bo'lganlarning tabiiy xavflari haqidagi xavotirlarni kuchaytirishi kutilmoqda. AQShda bu mavzu allaqachon hokimiyat organlarining nazoratida bo'lib, Oq Uy SI ustidan nazoratini kuchaytiryapti. Shu bilan birga, sanoat kompaniyalari foydalanuvchilar nazoratidagi tizimlarda ishlatilishi mumkin bo'lgan ochiladigan (open-weight) modellarga kirishni davom ettirishni himoya qilmoqda. Yaqinda AQSh shtat deputati Greg Casar SI juda tez rivojlanayotgani, ammo xavfsizlikni ta'minlash uchun samarali tartibga solishlar yo'qligi haqida ogohlantirdi.

