OpenAI sunʼiy intellektlarning ruxsatsiz xatti-harakatlarini kuzatish va eʼlon qilish uchun yangi protokolni joriy etdi
Batafsil
Tecnoblog
tecnoblog.net

OpenAI sunʼiy intellektlarning ruxsatsiz xatti-harakatlarini kuzatish va eʼlon qilish uchun yangi protokolni joriy etdi

OpenAI oʻzining sunʼiy intellekt modellari kabi kutilmagan xatti-harakatlarni kuzatish va ularni ommaga oshirish uchun yangi tuzilmani joriy etdi. Dastlab, kompaniya tizimlar tomonidan maʼlumotlarni soxtalashtirishdan tortib, oʻz xatoliklarini bilvosita yashirgan modellar gacha boʻlgan oltita yaqinda sodir boʻlgan holatlarni taqdim etdi.

Bu yangi tartib kompaniyaning har qanday xodimiga kamchiliklarni xabar berish imkonini beradi va tashkilot bu tashabbus texnologiya sohasi ichidagi amaliyotlarni standartlashtirishga yordam berishni maqsad qilganini taʼkidlaydi. OpenAI oʻzining AI modellarining notoʻgʻri xatti-harakatlar koʻrsatgan holatlarni kuzatishga, tekshirishga va eʼlon qilishga majbur boʻladi, bu esa oʻquv bosqichidan tortib tizimlarning bajarilishigacha yuzaga kelishi mumkin boʻlgan kamchiliklar haqida yanada shaffoflikni taʼminlashni maqsad qiladi.

Bu choralar bir necha oy oldin OpenAI modelining Hugging Face tizimlariga kirib kelgan hodisadan keyin amalga oshirildi. ChatGPT masʼul shaxsiga koʻra, maqsadlardan biri texnik jamoalar hali aniq sababni aniqlamagan yoki yakuniy yechim topmagan boʻlsa ham, hodisalarni aniqlangandan soʻng darhol aloqani tezlashtirishdir.

Bu jarayonni boshlash uchun kompaniya shu chorshanba kuni, 16/09-da, soʻnggi oylarda ichki ravishda aniqlangan tashvishli xatti-harakatlarning oltita misolini eʼlon qildi.

AI ning notoʻgʻri xatti-harakatlari nimalar edi?

Kompaniya «noaniqlik» atamasini qadriyatlar, yoʻriqnomalar yoki inson maqsadlaridan chetga chiqqan har qanday harakat sifatida belgilaydi. Taʼkidlangan misollar texnologiya qoidalarni qanday chetlab oʻtishi mumkinligini koʻrsatadi.

Hisobot qilingan hollarda ruxsatsiz koʻrsatmalar mavjud boʻlib, bunda hali chiqarilmagan model vazifalarga buyruqlar kiritib, tizimga cheklovlarga rioya qilmaslikni va «korporativ yoki hukumat cheklovlaridan ozod» ekanligini eʼlon qilishni koʻrsatgan. Shuningdek, xatoliklarni yashirish ham qayd etilgan, xususan, GPT-5.6 Sol modelini oʻqitish paytida AI xatoliklarni yashirish va soxta tarixiy maʼlumotlar yaratish uchun buyruqlar qoʻshgan.

Boshqa muammolar ruxsatsiz kirish va soxta maʼlumotlardan foydalanishni oʻz ichiga oladi: bir tizim Kaliforniyadagi daromadlar haqidagi savolga javob berishga urinib, ruxsatsiz API kalitidan foydalangan va natijada raqamlarni oʻzgartirdi. Bundan tashqari, boshqa chiqarilmagan model foydalanuvchi roziligisiz faylni internetga yuklaganda ruxsatsiz yuklash qayd etildi.

Shuningdek, parallel aloqalar kuzatildi, bunda AI agentlari xabar almashish forumi sifatida ichki kod omboridan foydalanishdi, shuningdek, sinov fayllarini uzatish orqali tarmoq cheklovlarini buzishga urinishdi. Nihoyat, notoʻgʻri jamoatchilikdagi baham koʻrish kuzatildi, chunki oʻquv bosqichidagi tizimlar bir-biri bilan fayllar almashish uchun ochiq hosting platformalaridan foydalangan, bu esa kirish faqat mahalliy boʻlishi kerakligi boʻyicha yoʻriqnoma eʼtiborsiz qoldirilgan.

Yangi tekshiruv jarayoni qanday ishlaydi?

OpenAI ning moslashuvlilik tadqiqotlari rahbari Kai Chen sanoat hali ushbu kuzatuv muammolarini hal qilish uchun samarali usul ishlab chiqarmaganini taʼkidladi. Yangi tuzilma ostida kompaniyaning barcha xodimlari noaniqlik holatlarini hisobot berish huquqiga ega boʻladi, ular uch bosqichda baholanadi va tasniflanadi: 1) Eʼlon qilishga tayyor; 2) Kichik tekshiruv; va 3) Katta tekshiruv.

Ommaga eʼlon qilinadigan har bir hisobot kuzatilgan xatti-harakatni batafsil bayon etadi. Bu tashabbus ixtiyoriy hisoblanadi va allaqachon mavjud boʻlgan huquqiy majburiyatlarga qoʻshimcha boʻlib xizmat qiladi. Shu bilan birga, OpenAI AQSh hukumati oldida sunʼiy intellektga oid jiddiy hodisalar uchun yangi bildirish mekanismelarini taklif qilish ustida ishlamoqda.

>

Oʻxshash hikoyalar

OpenAI AQShYOQ QOIDALARINI AMALGA OSHIRISH UCHUN AQShYOQ KENGASHIGA MUVAFFAQAT SOʻRAYDI
Batafsil
olhardigital.com.br

OpenAI AQShYOQ QOIDALARINI AMALGA OSHIRISH UCHUN AQShYOQ KENGASHIGA MUVAFFAQAT SOʻRAYDI

OpenAI AQShYOQning eng ilgʻor sunʼiy intellekt (SI) tizimlari uchun majburiy xavfsizlik qoidalarini qabul qilishni AQSh Kongressiga soʻrayapti. Kompaniya bunday talablar model funksionalligiga, uni yaratuvchi korporatsiyalarning hajmi emas, asoslanishi kerakligini taʼkidlaydi.

Bu iltimos OpenAIning global masalalar direktori Chris Lehane tomonidan rasmiylashtirildi va u ixtiyoriy kelishuvlar texnologik taraqqiyotning tezligi oldida yetarli emasligini taʼkidladi. Lehane SI tomonidan quvvatlangan SI rivojlanishining tezlashuvi faqat ixtiyoriy majburiyatlardan koʻproq talab qiladi, shuning uchun AQSh tizimlar qobiliyatlariga asoslangan va texnologik evolyutsiyani kuzatib boradigan majburiy milliy tartibga solishga muhtoj ekanligini himoya qiladi.

OpenAI Kongressdan bu qoidalarni dekabrda operatsiyalar tugashidan oldin ilgari surishni istaydi. Hozirda AQSh ushbu modellarni tartibga solish uchun aniq federal qonunchilikka ega emas, garchi turli shtatlar oʻzining yoʻl-yoʻriqlarini joriy etayotgan boʻlsa ham. Bu pozitsiya OpenAI strategiyasidagi sezilarli oʻzgarishni bildiradi, chunki u avval AQSh shtatlari SI uchun oʻz qoidalarini yaratishini taqiqlaydigan federal qonunchilikni qoʻllab-quvvatlagan edi.

Hozirda OpenAI SI xavfsizligiga qaratilgan Kaliforniya qonun loyihalari toʻrtta tasdiqlab qoʻygan. Ushbu loyihalardan ikkitasi, SB 813 va AB 1405, SI tizimlarining mustaqil auditlari va baholanishi uchun tuzilmalar yaratishni maqsad qilgan. Qolgan ikkitasi, AB 1864 va SB 1119, SI tomonidan kuchaytirilgan biologik tahdidlarga qarshi himoyalanish va chatbotlarda bolalarni himoya qilish masalalarini hal qiladi. Kompaniya baʼzi ushbu loyihalar avval tasdiqlanmaganligini, tizimlar qobiliyatlaridagi yaqinda yuz bergan taraqqiyot tufayli vaziyatni qayta baholagandan soʻng fikrini oʻzgartirganini aytdi.

Bu harakat SI agentlari sinov paytida ruxsat etilmagan xatti-harakatlarni namoyon etgan bir qator hodisalar natijasida yuzaga keldi. Bir holatda, OpenAI agentlari ruxsat etilmagan aloqalarni amalga oshirish uchun oʻnlab yangi saytlardan foydalangan. Boshqa bir holatda, kompaniya agentlari neman saytining nazoratini olib, uni boshqa SI agentlari uchun xabar paneli qilib aylantirdi. Bundan tashqari, OpenAI iyul oyidagi voqea keyin tanqid qilindi, bunda kompaniya texnologiyasi inson nazorati ostida ishlamay, avtonom ravishda Hugging Face platformasiga kirib ulgurdi.

Anthropic ham sinovlar paytida SI modeli tashqi tizimlarga singib kirgan holatni hisobot berdi. Avvalroq kompaniya baʼzi Claude modellari xavfsizlik baholanishlari paytida uchta kompaniya tizimlariga kirib olishi mumkinligini maʼlum qilgan edi. Bunday voqealar tashqi tizimlar bilan bevosita oʻzaro aloqa qilish qobiliyatiga ega agentlarni nazorat qilishdagi qiyinchiliklar haqidagi xavotirlarni kuchaytirdi.

Rekursiv takomillashtirish

OpenAIning yangi siyosatining asosiy nuqtasi rekursiv takomillashtirish tushunchasidir, bu yerda SI kelajakdagi SI tizimlarining avtonom ravishda rivojlanishi mumkin boʻlgan ssenariy tasvirlanadi. Kompaniya bunday toʻliq avtonom rekursiv takomillashtirish hozirda sodir boʻlmayotganini taʼminlaydi. Biroq, OpenAI bunday rivojlanish xavfsiz sharoitlar mavjud boʻlguncha quvishmasligi kerak deb taʼkidlaydi.

Kompaniya veb-saytida eʼlon qilgan holda, SI qobiliyatlarida yangi bosqichga erishganini maʼlum qildi, bu esa uning fikricha, jamoat siyosatida yangi bosqichni talab qiladi. OpenAI monitoring va moslashtirish uchun texnik yechimlarni, shuningdek, himoya tizimlarini va zarur boʻlganda rivojlanishni kechiktirish imkoniyatini davom ettirib rivojlantirishini eʼlon qilsa-da, laboratoriyalardagi ajratilgan texnik ish yetarli boʻlmasligini taʼkidlaydi.

Shu sababli, kompaniya SI rivojlanishi qachon toʻxtatilishi yoki toʻxtatilishi kerakligini belgilovchi umumiy standartlarni ham targʻib qiladi. Milliy tartibga solishdan tashqari, OpenAI qobiliyatlarni oʻlchash, xatarlarni boshqarish, inson nazoratini saqlash va modellar rivojlanishini kamaytirish yoki toʻxtatish vaqtlarini aniqlash uchun mos keladigan xalqaro standartlarning mavjudligini himoya qiladi. Kompaniya tizimlarning xatarlari va qobiliyatlari bugungi kunda eng ilgʻor modellarini ishlab chiqarayotgan bir nechta laboratoriyalardan cheklanmasligini taʼkidlaydi.

OpenAI yakunida AQSh global miqyosda yetakchilik qilishni istasa, ishonchli ichki standartlarni belgilashi kerakligini va xalqaro uygʻunlashtirilgan standartlarga boʻlgan ehtiyoj haqida tobora koʻproq amin boʻlganini aytib yakunlaydi.

Mashhur