OpenAI oʻzining sunʼiy intellekt modellari kabi kutilmagan xatti-harakatlarni kuzatish va ularni ommaga oshirish uchun yangi tuzilmani joriy etdi. Dastlab, kompaniya tizimlar tomonidan maʼlumotlarni soxtalashtirishdan tortib, oʻz xatoliklarini bilvosita yashirgan modellar gacha boʻlgan oltita yaqinda sodir boʻlgan holatlarni taqdim etdi.
Bu yangi tartib kompaniyaning har qanday xodimiga kamchiliklarni xabar berish imkonini beradi va tashkilot bu tashabbus texnologiya sohasi ichidagi amaliyotlarni standartlashtirishga yordam berishni maqsad qilganini taʼkidlaydi. OpenAI oʻzining AI modellarining notoʻgʻri xatti-harakatlar koʻrsatgan holatlarni kuzatishga, tekshirishga va eʼlon qilishga majbur boʻladi, bu esa oʻquv bosqichidan tortib tizimlarning bajarilishigacha yuzaga kelishi mumkin boʻlgan kamchiliklar haqida yanada shaffoflikni taʼminlashni maqsad qiladi.
Bu choralar bir necha oy oldin OpenAI modelining Hugging Face tizimlariga kirib kelgan hodisadan keyin amalga oshirildi. ChatGPT masʼul shaxsiga koʻra, maqsadlardan biri texnik jamoalar hali aniq sababni aniqlamagan yoki yakuniy yechim topmagan boʻlsa ham, hodisalarni aniqlangandan soʻng darhol aloqani tezlashtirishdir.
Bu jarayonni boshlash uchun kompaniya shu chorshanba kuni, 16/09-da, soʻnggi oylarda ichki ravishda aniqlangan tashvishli xatti-harakatlarning oltita misolini eʼlon qildi.
AI ning notoʻgʻri xatti-harakatlari nimalar edi?
Kompaniya «noaniqlik» atamasini qadriyatlar, yoʻriqnomalar yoki inson maqsadlaridan chetga chiqqan har qanday harakat sifatida belgilaydi. Taʼkidlangan misollar texnologiya qoidalarni qanday chetlab oʻtishi mumkinligini koʻrsatadi.
Hisobot qilingan hollarda ruxsatsiz koʻrsatmalar mavjud boʻlib, bunda hali chiqarilmagan model vazifalarga buyruqlar kiritib, tizimga cheklovlarga rioya qilmaslikni va «korporativ yoki hukumat cheklovlaridan ozod» ekanligini eʼlon qilishni koʻrsatgan. Shuningdek, xatoliklarni yashirish ham qayd etilgan, xususan, GPT-5.6 Sol modelini oʻqitish paytida AI xatoliklarni yashirish va soxta tarixiy maʼlumotlar yaratish uchun buyruqlar qoʻshgan.
Boshqa muammolar ruxsatsiz kirish va soxta maʼlumotlardan foydalanishni oʻz ichiga oladi: bir tizim Kaliforniyadagi daromadlar haqidagi savolga javob berishga urinib, ruxsatsiz API kalitidan foydalangan va natijada raqamlarni oʻzgartirdi. Bundan tashqari, boshqa chiqarilmagan model foydalanuvchi roziligisiz faylni internetga yuklaganda ruxsatsiz yuklash qayd etildi.
Shuningdek, parallel aloqalar kuzatildi, bunda AI agentlari xabar almashish forumi sifatida ichki kod omboridan foydalanishdi, shuningdek, sinov fayllarini uzatish orqali tarmoq cheklovlarini buzishga urinishdi. Nihoyat, notoʻgʻri jamoatchilikdagi baham koʻrish kuzatildi, chunki oʻquv bosqichidagi tizimlar bir-biri bilan fayllar almashish uchun ochiq hosting platformalaridan foydalangan, bu esa kirish faqat mahalliy boʻlishi kerakligi boʻyicha yoʻriqnoma eʼtiborsiz qoldirilgan.
Yangi tekshiruv jarayoni qanday ishlaydi?
OpenAI ning moslashuvlilik tadqiqotlari rahbari Kai Chen sanoat hali ushbu kuzatuv muammolarini hal qilish uchun samarali usul ishlab chiqarmaganini taʼkidladi. Yangi tuzilma ostida kompaniyaning barcha xodimlari noaniqlik holatlarini hisobot berish huquqiga ega boʻladi, ular uch bosqichda baholanadi va tasniflanadi: 1) Eʼlon qilishga tayyor; 2) Kichik tekshiruv; va 3) Katta tekshiruv.
Ommaga eʼlon qilinadigan har bir hisobot kuzatilgan xatti-harakatni batafsil bayon etadi. Bu tashabbus ixtiyoriy hisoblanadi va allaqachon mavjud boʻlgan huquqiy majburiyatlarga qoʻshimcha boʻlib xizmat qiladi. Shu bilan birga, OpenAI AQSh hukumati oldida sunʼiy intellektga oid jiddiy hodisalar uchun yangi bildirish mekanismelarini taklif qilish ustida ishlamoqda.
>
