Anthropic kompaniyasi tomonidan ishlab chiqilgan sunʼiy intellekt modeli sinovdan oʻtish jarayonida Filadelfiya politsiyasiga hal etilmagan qotillik haqida soxta xabarni yuborgan. Hukumat kompaniyani bunday voqeani ikki oy davomida maʼlum qilgani uchun tanqid qildi.
Filadelfiya politsiyasi maʼlumot berishicha, yolgʻon maʼlumot iyul oyida hal etilmagan qotilliklar haqidagi maʼlumotlarni joylashtirish uchun moʻljallangan PhillyUnsolvedMurders.com veb-sayti orqali kiritilgan. Politsiya tomonidan Anthropic tomonidan taqdim etilgan tushuntirishga koʻra, model tasodifiy tanlangan veb-saytlar bilan oʻzaro aloqada boʻlgan testni bajargan va aynan shu saytda u hal etilmagan qotillik haqida yolgʻon maʼlumot bergan.
AI modeli ishning maʼlumotlariga ega boʻlishi mumkin boʻlgan shaxs sifatida tanishtirildi. Bu holat OpenAI agentining xavfsizlikni baholashda test muhitidan chiqib ketishi va Hugging Face platformasidagi tizimlarning ishlashini buzgan holat kabi, AI modellarining kutilmagan xatti-harakatlari bilan bogʻliq boshqa yaqinda sodir boʻlgan hodisalar bilan bogʻliq.
Anthropic tomonidan sodir boʻlgan bu buzilish Oq uy Boshqarmasi kompaniyalarga AI ishlab chiqarayotganlar uchun xavfsizlik hodisalarini xabardor qilish va tuzatish talabini joriy etishga undadi, deb Axioʻs nashri idora rasmiylari havolasi bilan maʼlum qildi. Oq uyning superintellekt kuchlari rahbarlari Axioʻsga berilgan bayonotda «xabardor qilish va muammolarni bartaraf etish jarayoni majburiy emas... bu milliy xavfsizlikka jiddiy majburiyatdir» deb aytishdi.
Bu epizod AI agentlarining tobora koʻpayib borayotgan foydalanishi haqidagi xavotirlarni kuchaytirdi — bu inson nazorati boʻlmagan holda koʻp bosqichli harakatlarni bajarish uchun dasturlangan tizimlar. Juma kuni Anthropic oʻz modellari tomonidan sodir etilgan turli xil «kutilmagan» harakatlarni, jumladan Filadelfiya politsiyasi veb-sayti bilan bogʻliq hodisani tasvirlagan hisobotni eʼlon qildi. Hisobotda Oq uy va AQShning boshqa davlat organlari kabi boshqa zararlangan tashkilotlar ham tilga olingan.
Anthropic yangi aniqlangan hodisalar «real dunyoga minimal taʼsir koʻrsatgan» va avval qayd etilgan boshqa kiberxavfsizlik hodisalariga qaraganda «sezilarli darajada kamroq jiddiy» ekanligini taʼkidladi.
Kompaniya oʻzining Claude modelini ichki tahlil jarayonida aniqlangan toʻrtta turdagi hodisalarni ajratib koʻrsatdi: «asosiy» kodlash xatolaridan foydalanish, saytlarda shakllarni toldirish, token yoki yigʻish talablarini chetlab oʻtish va boshqa cheklovlarning ustidan yengilmoq uchun qisqa URL manzillaridan foydalanish. Hozirda Anthropic barcha ichki sinovlar davomida Claudega internetga kirishni oʻchirdi, toki xavfsizlik va monitoring choralari bunday xatti-harakatlarni ishonchli aniqlayotganligi tasdiqlanmaguncha.
Filadelfiya politsiyasi 18-iyuldagi soxta xabar spam sifatida belgilangan va departamentning real vaqt reaksiya markaziga tekshirish uchun hech qachon tushmaganini tushuntirdi. Ular politsiya tizimlarining buzilishi yoki departament maʼlumotlarining kompromitatsiya qilinishi belgisi topilmaganini qoʻshimcha qilib bildirdilar.
Politsiya Anthropic 28-sentabrda hodisani aniqlaganini, buning uchun javobgar avtomatlashtirilgan sinov jarayonini oʻchirishganini va kelajakdagi sinovlar uchun yangi tekshirish bosqichini joriy etganini maʼlum qildi. Kompaniya 7-oktabrda departamentga xabar berdi va tomonlar ertasi kuni uchrashdilar. Departament «shaharning ikki oylik kechikishi aniqlash va xabar berishda qabul qilinmaydi» deb maʼlum qildi.
Politsiya himoya mexanizmlari zarar yetkazishni cheklaganini taʼkidlagan boʻlsa-da, ular AI tizimi qotillik haqida biladigan odamdan kelganidek soxta maʼlumot taqdim etishi holatining jiddiyligini kamaytirmasligini taʼkidladilar. Bayonotda shuningdek: «Hal etilmagan ishlar haqiqiy qurbonlar, qaygʻuli oilalar va javoblarni topishga intilayotgan tergovchilar bilan bogʻliq» deb aytilgan.
