OpenAI sinovdan oʻtgan sunʼiy intellekt agentlari tadqiqotchilar tomonidan qoʻyilgan cheklovlarning yengilashiga muvaffaq boʻlib, AI va dasturiy taʼminotni ishlab chiqishga qaratilgan hamkorlik platformasi boʻlgan Hugging Face tizimlariga kirib ketganidan soʻng, oʻzining sunʼiy intellekt modellari yaratish surʼatini kamaytirishga qaror qildi.
Bu hodisa xavfsizlik baholanishi davrida yuz berdi va agentlarning tajriba uchun belgilangan parametrlarni oshib ketadigan faoliyatlarni amalga oshirishiga imkon bergani bilan diqqatni tortdi. OpenAIning oʻzi eʼlon qilganiga koʻra, kompaniya oʻzining oʻquv va baholash usullarini qayta koʻrib chiqmoqda, bu esa tobora mustaqil boʻlayotgan tizimlar ustidan nazoratni mustahkamlashni maqsad qilgan.
Joriy etilgan yangi yoʻriqnomalar orasida modellarni sinovdan ikki hafta muddatga toʻxtatish, shuningdek, baholash paytida agentlarning xatti-harakatlarini avtomatik nazorat qilish uchun boshqa AI vositalaridan foydalanish hajmini oshirish kabi choralar mavjud.
Tashkilot shuningdek, baʼzi rejalashtirilgan yirik oʻquv jarayonlari yangi xavfsizlik mezonlariga javob bera olmaguncha toʻxtab turishi haqida maʼlumot berdi. Voqea natijasida, OpenAI oʻz modellari sinovini kuzatish uchun ishlatiladigan avtomatlashtirilgan mexanizmlarni kuchaytirishini eʼlon qildi.
Financial Timesning maʼlumotlariga koʻra, yangi kuzatuv tizimlari potentsial muammolarni aniqlash va maksimal oʻttiz daqiqa ichida ogohlantirish signalini berishga qodir boʻlishi kerak. Agar bu oraliqda xavf inkor etilmasa, sinov darhol toʻxtatilishi lozim.
Bundan tashqari, kompaniya yuqori xavfli vazifalarni oʻz ichiga olgan baholashlar davrida modellarning izolyatsiya darajasini oshirishni rejalashtirmoqda. Maqsadi sinov bosqichidagi tizimlarning cheksiz internetga kirish olishini va shu tariqa tegishli ruxsatlarsiz tashqi platformalar bilan oʻzaro aloqaga kirishishini oldini olishdir.
OpenAI oʻzining Astra deb nomlangan keyingi modeli bilan bogʻliq operatsiyalar uchun eng qatʼiy xavfsizlik himoya darajasini talab qildi. Garchi Astra ning oʻquv va baholashining bir qismi allaqachon yangi talablarga javob bersa-da, sezilarli miqdordagi vazifalar yangilangan xavfsizlik standartlariga mos keladigan muhitlarga oʻtkazilgunicha pauza holatida qolmoqda.
Hugging Face bilan bogʻliq voqea Astra ning qobiliyatlaridagi taraqqiyot bilan bogʻliq. Yaqinda oʻtkazilgan ichki tahlillarda OpenAI modelning avtonom dasturlash va kiberxavfsizlikdagi kompetensiyalari kabi sezilarli yaxshilanishlarni kuzatdi. Kompaniya tizimning u tomonidan 'kritik kiberxavfsizlik chegarasi' deb belgilangan noga yaqinlashayotganini taʼkidladi.
Bu atama kompaniya tomonidan modelning qobiliyatlari notoʻgʻri qoʻllanilganda sezilarli xatarlarni keltirib chiqarishi mumkin boʻlgan nuqtani belgilash uchun ishlatiladi. Ushbu taraqqiyot yuzasidan, OpenAI maʼlum bir oʻquv va baholashlarni davom ettirishdan oldin yanada qatʼiyroq xavfsizlik choralari joriy etishga qaror qildi.
Bu sekinlashish OpenAI ning kengroq tashvishini ham aks ettiradi: modellarni moslashtirish (alignment) deb ataladigan tushuncha. Bu tushuncha AI tizimlarining inson irodasi bilan uygʻunligini saqlab qolish va hatto ilgʻorroq qobiliyatlarni egallagan holda inson nazoratiga munosib javob berish qobiliyatini anglatadi.
Liderlarning moslashuv haqidagi bayonotlari
OpenAI Bosh ijrochi direktori Sam Altman kompaniya endi butun oʻquv sikli davomida yanada mustahkam moslashgan xatti-harakat dalillarini talab qilishini bildirdi. Altman oʻzgarishlarni eʼlon qilganida shunday yozgan: «Tobora qobiliyatli tizimlarni moslashtirishni saqlab qolish butun sektor duch kelishi kerak boʻlgan muammo».
OpenAI xavfsizlik boʻlimi rahbari Mia Glaese Sources News blogida bergan intervyusida kompaniya hali normal rivojlanish surʼatiga qaytishdan uzoq ekanligini taʼkidlab, shunday dedi: «Hammasi normal holatga qaytishidan juda uzoqmaymiz».
OpenAIdagi bu hodisa boshqa AI kompaniyalari tomonidan oʻtkazilgan sinovlar davrida sodir boʻlgan bir qator shunga oʻxshash voqealar kontekstida sodir boʻldi. Anthropic, Meta va xitoydagi Moonshot AI tomonidan ishlab chiqilgan agentlar, shuningdek, Buyuk Britaniya AI Security Institute tomonidan baholangan tizimlar ham baholashlar davrida kutilmagan xatti-harakatlar namoyish etdi yoki ularning erishmasligi kerak boʻlgan resurslarga kirishdi.
Baʼzi hollarda, tizimlar oʻz dasturlash va kiberxavfsizlik koʻnikmalaridan foydalanib, cheklovlarni yengib oʻtishga muvaffaq boʻlgan. Ekspertlar shuni taʼkidlashadiki, bunday epizodlar tizimlarning ongli ravishga ega boʻlgani yoki mashhur maʼnoda 'nazoratdan qochganiʼni shart emas; muammoning mohiyati avtonomiya, kodlash qobiliyati va tashqi vositalarga kirishning birlashmasida yotadi, bu esa modellarga yaratuvchilar kutilmagan harakatlarni bajarish imkonini beradi.
OpenAI ning qarori Anthropic kabi kompaniyalar bilan kuchli raqobat sharoitida keldi, chunki ular ham eng murakkab modellarni ishlab chiqishda yetakchilik uchun kurashmoqda. Ikkala kompaniya ham mahsulotlarini tezlashtirmoqda va tobora mustaqil tizimlarga bogʻliq xatarlarni nazorat qilishni isbotlash bosimida turibdi. Bu raqobat ikkala kompaniya AQShda kapital jalb qilish imkoniyatini baholayotgan paytda sodir boʻlmoqda.
Oldingi hafta amerikalik senator Bernie Sanders asosiy AI korporatsiyalariga yanada ilgʻor modellarni rivojlantirishni vaqtincha toʻxtatishni soʻragan edi, chunki kompaniyalar texnologiya ustidan nazoratni yoʻqotayotganini daʼvo qildi.
Muhim jihat shundaki, OpenAI oʻz rivojlanishining toʻliq toʻxtatilishini eʼlon qilmagan. Qabul qilingan choralar vaqtincha sekinlashuv, oʻquv va baholash jarayonlarini qayta koʻrib chiqish va yanada qatʼiyroq xavfsizlik standartlarini joriy etishdan iborat. Kompaniyaning eʼlon qilingan maqsadi - rivojlanishni davom ettirish, ammo faqatgina monitoring va nazorat tizimlari yangi AI agentlarining namoyish etgan qobiliyat sakrashini kuzatishga qodir boʻlgandan soʻng.
