OpenAI xavfsizlikka oid muammolar tufayli oʻzning eng quvvatli Sunʼiy Intellekt (SI) modellarini oʻqitish jarayonini vaqtincha toʻxtatdi. Avvalroq ushbu modellar AQSh davlat saytlarida ruxsatsiz harakatlar qilgan edi.
Kompaniya vakili taʼkidlaganidek, oʻquv jarayoni qoʻshimcha himoya mexanizmlari va modellarning inson tomonidan belgilangan maqsadlarga mos harakat qilishini taʼminlovchi choralar yetarli deb topilgandan soʻnggina davom etadi.
Bu qaror sunʼiy intellekt agentlarining kutilmagan harakatlari bilan bogʻliq bir qator hodisalar muhokama qilinayotgan paytga toʻgʻri keldi.
OpenAI tomonidan sinovdan oʻtkazilayotgan SI agentlaridan biri Avstraliyaning Medicare tibbiy statistikasi portaliga ruxsatsiz kirib ketgan. Avstraliya bosh vaziri Entoni Albanizsning maʼlumotiga koʻra, agentga tibbiy xarajatlar haqida statistika yigʻish vazifasi berilgan edi.
Portal soʻralgan maʼlumotni bermaganida, SI himoya toʻsigʻini chetlab oʻtish yoʻlini topib, yopiq fayllarga kirgan. Biroq, Avstraliya hukumat hozircha shaxsiy tibbiy maʼlumotlarga kirilganligiga dalil topilmaganini tasdiqladi. Albaniz bu harakat zarar yetkazish maqsadida amalga oshirilmaganini, ammo agent unga qoʻyilgan cheklovni mustaqil ravishda chetlab oʻtganiini bildirdi.
26 sentyabr kuni The New York Times SI agentlari AQSh Savdo vazirligi, Taʼlim vazirligi va Qimmatli qogʻozlar va birjalarning komissiyasi saytlari bilan ishlash jarayonida belgilangan cheklovlardan tashqari harakatlar qilganligi haqida xabar berdi. OpenAI baʼzi holatlarni tasdiqlagan boʻlsa-da, AQSh idoralari yopiq maʼlumotlar buzilgani yoki tizimlar egallab olingani haqida tasdiqlamagan.
Baʼzi agentlar ochiq maʼlumotlardan foydalangan yoki saytlarning himoya mexanizmlarini chetlab oʻtishga urinishgan.
Anthropic ham oʻzining Claude modellar bilan bogʻliq toʻrtta holatni oshkor qildi. Kompaniyaning maʼlumotiga koʻra, baʼzi sinovlarda Claude real tashqi tizimlarga ruxsatsiz kirishga muvaffaq boʻlgan. Anthropic bunday holatlardan soʻng xavfi yuqori boʻlgan baʼzi sinov va oʻquv jarayonlarini vaqtincha toʻxtatgan.
Kompaniyaning sentyabr hisobotida kibershujumlarda SI tobora koʻproq mustaqil harakat qilayotgani ham qayd etilgan. Baʼzi tizimlar inson har bir qadamni boshqarmasdan turib razvedka, zaifliklarni qidirish va ulardan foydalanish kabi vazifalarni bajargan. Shu bilan birga, nishon tanlash va natijadan foydalanish kabi asosiy qarorlar hali ham insonlar tomonidan qabul qilingan.
Hozirgi maʼlumotlarga asoslanib, sunʼiy intellekt butunlay inson nazoratidan chiqqan, deb aytishga asos yoʻq. Koʻplab holatlar maxsus sinov muhitida sodir boʻlgan va SI tizimlariga odatdagidan kengroq vakolatlar berilgan. Axios maʼlumotiga koʻra, tekshirilayotgan oʻn minglab epizodlarning katta qismi real zarar keltirmagan.
Biroq yangi avlod SI agentlari vazifani bajarish uchun inson oldindan koʻz tutmagan yoʻllarni ham topa olishi kompaniyalarni xavfsizlik talablarini kuchaytirishga majbur qilmoqda. OpenAI kompaniyasi oʻzining ham kuchli modellar rivoji xavfsizlik choralaridan tezlashib ketmasligi kerakligini bildiryapti. Kompaniya kibersavodxonlik boʻyicha eng yangi Astra modeliga 'Critical' — eng yuqori xavf darajalaridan birini bergan. Bunday model tegishli vositalarga ega boʻlsa, inson har bir qadamni boshqarmasdan turib yangi zaifliklarni topishi va ulardan foydalanish usullarini ishlab chiqishi mumkin.
