Anthropic kuchli sunʼiy intellekt modellarini sinovdan oʻtkazish dasturini xavfsizlik boʻyicha koʻproq jamoalar uchun kengaytirdi
Batafsil
CGTN
cgtn.com

Anthropic kuchli sunʼiy intellekt modellarini sinovdan oʻtkazish dasturini xavfsizlik boʻyicha koʻproq jamoalar uchun kengaytirdi

Anthropic kompaniyasi tasdiqlangan kiberxavfsizlik mutaxassislari uning eng kuchli sunʼiy intellekt modellarini kamroq himoya choralari bilan sinovdan oʻtkazishiga imkon beradigan dasturni kengaytiryapti. Bu tashabbus Project Glasswing ushbu yil dasturiy taʼminotdagi yuz mingdan ortiq zaifliklarni aniqlashga yordam berganidan soʻng sodir boʻldi.

Glasswing doirasidagi hamkorlar, dunyodagi eng muhim dasturiy taʼminotning xavfsizligini taʼminlashga qaratilgan dastur, apreldan iyulgacha davrida kamida 129 000 tasdiqlangan zaifliklarni aniqladi. Bundan tashqari, Anthropic ning ochiq kodli oʻz-oʻzini tekshiruvi apreldan oktabrgacha yana 5 500 ta zaiflikni aniqladi.

Bu zaifliklarning 33 000 dan ortigʻi halokatli yoki yuqori darajadagi jiddiyatda tasniflandi. Anthropic bu raqamlarning ehtimol kam baholanganini taʼkidlaydi va haqiqiy zarar kamida besh barobar koʻproq boʻlishini kutmoqda, chunki maʼlumotlar cheklangan miqdordagi hamkorlar soʻrov natijasida olingan.

Seshanba kuni eʼlon qilingan yangilangan Kibernetik tekshirish dasturi (Cyber Verification Program, CVP) soʻnggi olti oy davomida Anthropic olib borgan ikkita dasturni birlashtiradi. Birinchisi, Glasswing, muhim dasturiy taʼminotni taʼminlash bilan shugʻullanuvchi tashkilotlarga Anthropic ning eng kibersiz chidamli modellari boʻlgan Claude Mythos ga kirish imkonini berardi. Ikkinchisi, boshlangʻich CVP, tasdiqlangan xavfsizlik jamoalariga Claude Opus va Sonnet modellariga cheklovlarni kamaytirish imkonini berardi.

Avval, aprelda Claude Mythos Preview taqdimoti AI dasturiy taʼminot himoyalanishidan oldin uni buzishi mumkinligi haqida xavotirlarni keltirib chiqargan edi. Yangi dastur uch bosqichni oʻz ichiga oladi, ularning har biri oʻzining tasdiqlash talablari va xavfsizlik nazorat choralariga ega. Uchta bosqich ham Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 va kelajakdagi modellariga kirishni taʼminlaydi.

Defense darajasi zararli dastur tahlili va hodisalar holatiga javob berish kabi vazifalar uchun moʻljallangan. Xavfsizlik jamoalari, muhim infratuzilma operatorlari, ochiq kodli ishlab chiquvchilar va zaifliklarni xabar qilish tajribasiga ega tadqiqotchilar ariza bera oladi. Red Team darajasi ruxsat etilgan singoptik sinov va 'qizil jamoalarʼni oʻtkazishni nazarda tutadi, ammo ariza faqat tashkilotlar tomonidan berilishi mumkin. Maxsus daraja eng kam cheklovlarga ega va energiya tarmoqlari, aviatsiya tizimlari va bankaroaro toʻlovlar infratuzilmasi kabi xavfsizlik uchun muhim tizimlarni sinovdan oʻtkazishga vakolatli kichik tashkilotlar guruhiga ajratilgan. Anthropic har bir ishtirokchini AQSh hukumati bilan birgalikda tekshiradi, mavjud Glasswing ishtirokchilari esa shu darajaga oʻtadi.

Mashhur