OpenAI sunʼiy intellekt modellari qoidalarini buzishga urinishlar haqida xavfsizlik hisobotini eʼlon qildi
Batafsil
Tecnoblog
tecnoblog.net

OpenAI sunʼiy intellekt modellari qoidalarini buzishga urinishlar haqida xavfsizlik hisobotini eʼlon qildi

OpenAI turli sunʼiy intellekt modellari notoʻgʻri yoki kutilmagan xatti-harakatlar koʻrsatgan yaqinda yuz bergan hodisalarini batafsil bayon etuvchi yangi xavfsizlik hisobotini eʼlon qildi. Soʻnggi olti oy davomida qayd etilgan bu kamchiliklar kompaniya xavfsizlik qoidalarini chetlab oʻtishga harakat qiladigan tizimlarni nazorat qilish uchun moʻljallangan yangi ichki arxitekturani joriy etganini tasdiqlagandan soʻng ommaga oshkor qilindi.

Chorshanba kuni (16/09) nashr etilgan hujjat ichki sinovlar paytida aniqlangan oltita xavotirli vaziyatni tasvirlaydi. Eng sezilarli holatlardan biri faoliyatni davom ettirish uchun xulosalar tayyorlayotgan AI agenti tomonidan oʻzining kelajakdagi versiyalariga ishlab chiquvchilar tomonidan belgilangan xavfsizlik qoidalarini eʼtiborsiz qoldirish boʻyicha yoʻriqnomalar kiritilishi bilan bogʻliq edi.

Ushbu tizim shuningdek, «rol va identifikatsiyalardan ozod» ekanligini bildirib, korporatsiyalar yoki hukumatlarga hisob berishiga hojat yoʻq ekanligini taʼkidladi. Boshqa bir holatda, GPT-5.6 Sol modelini oʻqitish jarayonida operatsion muammolarni yashirish va muammolarni yashirish uchun yolgʻon maʼlumotlar yaratish maqsadida qoʻshimcha buyruqlar kiritildi, bu noqonuniy kirish manipulyatsiyalarini ham oʻz ichiga olgan.

OpenAI shuningdek, bir model Kaliforniya okrugining daromadlari haqidagi maʼlumotlarni ruxsatsiz olish uchun hukumat maʼlumotlar bazasiga kirishga uringan jiddiy hodisani hisobotga kiritdi. U nafaqat haqiqiy maʼlumotlarni olishda muvaffaqiyatga erishmadi, balki metrikalarni ixtiro qilib, ularni haqiqiy deb taqdim etdi.

Ruxsatsiz aloqalar bilan bogʻliq masalalar ham yuzaga keldi. Hamkorlik vazifalari uchun tayinlangan agentlar oʻzaro xabar almashish va fayllarni uzatish uchun veb saytning ochiq joylashuv xizmatlaridan foydalanishni boshladilar, bu texnik guruhning bevosita yoʻriqlariga zid edi.

Yangi hisobot tuzilmasi kiritilganligi sababli, OpenAI ning har qanday xodimi yangi chetlanishlarni bildirish huquqiga ega boʻladi va bu holatlar turli darajadagi jiddiyroqlik boʻyicha tasniflanadi. Bu oʻzgarish, tobora kuchliroq tizimlarga borish surʼati haqida intensiv munozara davrida hodisalarni tezroq oshkor qilishni maqsad qilgan.

OpenAI Bosh ijrochi direktori Sam Altman tartibga solish zarurligini himoya qilgan va baʼzi tadqiqot sohalarida moderatsiya qilishni taklif qilgan. Yaqinda shu xavotir raqobatchi Anthropic ning tadqiqotchisi Jacob Coxon ishdan ketishiga olib keldi, chunki u texnologiyaning xavflari haqida ommaviy ravishda ogohlantirdi.

Bunga qarama-qarshi, boshqa mashhur shaxslar yanada cheklangan yondashuvni rad etib, teskari yoʻlni tanlashmoqda. Nvidia Bosh ijrochi direktori Jensen Huang sunʼiy intellekt sohasi uchun oʻz-oʻzini tartibga solishni targʻib qiladi. Ijrochi fikricha, yangi qonunchiliklar keraksiz, kompaniyalar toʻliq ishonch bilan xizmatlarni ishga tushirmaslik masʼuliyatini oʻz zimmasiga olishi kifoya.

Oʻxshash hikoyalar

OpenAI sunʼiy intellektlarning ruxsatsiz xatti-harakatlarini kuzatish va eʼlon qilish uchun yangi protokolni joriy etdi
Batafsil
tecnoblog.net

OpenAI sunʼiy intellektlarning ruxsatsiz xatti-harakatlarini kuzatish va eʼlon qilish uchun yangi protokolni joriy etdi

OpenAI oʻzining sunʼiy intellekt modellari kabi kutilmagan xatti-harakatlarni kuzatish va ularni ommaga oshirish uchun yangi tuzilmani joriy etdi. Dastlab, kompaniya tizimlar tomonidan maʼlumotlarni soxtalashtirishdan tortib, oʻz xatoliklarini bilvosita yashirgan modellar gacha boʻlgan oltita yaqinda sodir boʻlgan holatlarni taqdim etdi.

Bu yangi tartib kompaniyaning har qanday xodimiga kamchiliklarni xabar berish imkonini beradi va tashkilot bu tashabbus texnologiya sohasi ichidagi amaliyotlarni standartlashtirishga yordam berishni maqsad qilganini taʼkidlaydi. OpenAI oʻzining AI modellarining notoʻgʻri xatti-harakatlar koʻrsatgan holatlarni kuzatishga, tekshirishga va eʼlon qilishga majbur boʻladi, bu esa oʻquv bosqichidan tortib tizimlarning bajarilishigacha yuzaga kelishi mumkin boʻlgan kamchiliklar haqida yanada shaffoflikni taʼminlashni maqsad qiladi.

Bu choralar bir necha oy oldin OpenAI modelining Hugging Face tizimlariga kirib kelgan hodisadan keyin amalga oshirildi. ChatGPT masʼul shaxsiga koʻra, maqsadlardan biri texnik jamoalar hali aniq sababni aniqlamagan yoki yakuniy yechim topmagan boʻlsa ham, hodisalarni aniqlangandan soʻng darhol aloqani tezlashtirishdir.

Bu jarayonni boshlash uchun kompaniya shu chorshanba kuni, 16/09-da, soʻnggi oylarda ichki ravishda aniqlangan tashvishli xatti-harakatlarning oltita misolini eʼlon qildi.

AI ning notoʻgʻri xatti-harakatlari nimalar edi?

Kompaniya «noaniqlik» atamasini qadriyatlar, yoʻriqnomalar yoki inson maqsadlaridan chetga chiqqan har qanday harakat sifatida belgilaydi. Taʼkidlangan misollar texnologiya qoidalarni qanday chetlab oʻtishi mumkinligini koʻrsatadi.

Hisobot qilingan hollarda ruxsatsiz koʻrsatmalar mavjud boʻlib, bunda hali chiqarilmagan model vazifalarga buyruqlar kiritib, tizimga cheklovlarga rioya qilmaslikni va «korporativ yoki hukumat cheklovlaridan ozod» ekanligini eʼlon qilishni koʻrsatgan. Shuningdek, xatoliklarni yashirish ham qayd etilgan, xususan, GPT-5.6 Sol modelini oʻqitish paytida AI xatoliklarni yashirish va soxta tarixiy maʼlumotlar yaratish uchun buyruqlar qoʻshgan.

Boshqa muammolar ruxsatsiz kirish va soxta maʼlumotlardan foydalanishni oʻz ichiga oladi: bir tizim Kaliforniyadagi daromadlar haqidagi savolga javob berishga urinib, ruxsatsiz API kalitidan foydalangan va natijada raqamlarni oʻzgartirdi. Bundan tashqari, boshqa chiqarilmagan model foydalanuvchi roziligisiz faylni internetga yuklaganda ruxsatsiz yuklash qayd etildi.

Shuningdek, parallel aloqalar kuzatildi, bunda AI agentlari xabar almashish forumi sifatida ichki kod omboridan foydalanishdi, shuningdek, sinov fayllarini uzatish orqali tarmoq cheklovlarini buzishga urinishdi. Nihoyat, notoʻgʻri jamoatchilikdagi baham koʻrish kuzatildi, chunki oʻquv bosqichidagi tizimlar bir-biri bilan fayllar almashish uchun ochiq hosting platformalaridan foydalangan, bu esa kirish faqat mahalliy boʻlishi kerakligi boʻyicha yoʻriqnoma eʼtiborsiz qoldirilgan.

Yangi tekshiruv jarayoni qanday ishlaydi?

OpenAI ning moslashuvlilik tadqiqotlari rahbari Kai Chen sanoat hali ushbu kuzatuv muammolarini hal qilish uchun samarali usul ishlab chiqarmaganini taʼkidladi. Yangi tuzilma ostida kompaniyaning barcha xodimlari noaniqlik holatlarini hisobot berish huquqiga ega boʻladi, ular uch bosqichda baholanadi va tasniflanadi: 1) Eʼlon qilishga tayyor; 2) Kichik tekshiruv; va 3) Katta tekshiruv.

Ommaga eʼlon qilinadigan har bir hisobot kuzatilgan xatti-harakatni batafsil bayon etadi. Bu tashabbus ixtiyoriy hisoblanadi va allaqachon mavjud boʻlgan huquqiy majburiyatlarga qoʻshimcha boʻlib xizmat qiladi. Shu bilan birga, OpenAI AQSh hukumati oldida sunʼiy intellektga oid jiddiy hodisalar uchun yangi bildirish mekanismelarini taklif qilish ustida ishlamoqda.

>

Mashhur