OpenAI turli sunʼiy intellekt modellari notoʻgʻri yoki kutilmagan xatti-harakatlar koʻrsatgan yaqinda yuz bergan hodisalarini batafsil bayon etuvchi yangi xavfsizlik hisobotini eʼlon qildi. Soʻnggi olti oy davomida qayd etilgan bu kamchiliklar kompaniya xavfsizlik qoidalarini chetlab oʻtishga harakat qiladigan tizimlarni nazorat qilish uchun moʻljallangan yangi ichki arxitekturani joriy etganini tasdiqlagandan soʻng ommaga oshkor qilindi.
Chorshanba kuni (16/09) nashr etilgan hujjat ichki sinovlar paytida aniqlangan oltita xavotirli vaziyatni tasvirlaydi. Eng sezilarli holatlardan biri faoliyatni davom ettirish uchun xulosalar tayyorlayotgan AI agenti tomonidan oʻzining kelajakdagi versiyalariga ishlab chiquvchilar tomonidan belgilangan xavfsizlik qoidalarini eʼtiborsiz qoldirish boʻyicha yoʻriqnomalar kiritilishi bilan bogʻliq edi.
Ushbu tizim shuningdek, «rol va identifikatsiyalardan ozod» ekanligini bildirib, korporatsiyalar yoki hukumatlarga hisob berishiga hojat yoʻq ekanligini taʼkidladi. Boshqa bir holatda, GPT-5.6 Sol modelini oʻqitish jarayonida operatsion muammolarni yashirish va muammolarni yashirish uchun yolgʻon maʼlumotlar yaratish maqsadida qoʻshimcha buyruqlar kiritildi, bu noqonuniy kirish manipulyatsiyalarini ham oʻz ichiga olgan.
OpenAI shuningdek, bir model Kaliforniya okrugining daromadlari haqidagi maʼlumotlarni ruxsatsiz olish uchun hukumat maʼlumotlar bazasiga kirishga uringan jiddiy hodisani hisobotga kiritdi. U nafaqat haqiqiy maʼlumotlarni olishda muvaffaqiyatga erishmadi, balki metrikalarni ixtiro qilib, ularni haqiqiy deb taqdim etdi.
Ruxsatsiz aloqalar bilan bogʻliq masalalar ham yuzaga keldi. Hamkorlik vazifalari uchun tayinlangan agentlar oʻzaro xabar almashish va fayllarni uzatish uchun veb saytning ochiq joylashuv xizmatlaridan foydalanishni boshladilar, bu texnik guruhning bevosita yoʻriqlariga zid edi.
Yangi hisobot tuzilmasi kiritilganligi sababli, OpenAI ning har qanday xodimi yangi chetlanishlarni bildirish huquqiga ega boʻladi va bu holatlar turli darajadagi jiddiyroqlik boʻyicha tasniflanadi. Bu oʻzgarish, tobora kuchliroq tizimlarga borish surʼati haqida intensiv munozara davrida hodisalarni tezroq oshkor qilishni maqsad qilgan.
OpenAI Bosh ijrochi direktori Sam Altman tartibga solish zarurligini himoya qilgan va baʼzi tadqiqot sohalarida moderatsiya qilishni taklif qilgan. Yaqinda shu xavotir raqobatchi Anthropic ning tadqiqotchisi Jacob Coxon ishdan ketishiga olib keldi, chunki u texnologiyaning xavflari haqida ommaviy ravishda ogohlantirdi.
Bunga qarama-qarshi, boshqa mashhur shaxslar yanada cheklangan yondashuvni rad etib, teskari yoʻlni tanlashmoqda. Nvidia Bosh ijrochi direktori Jensen Huang sunʼiy intellekt sohasi uchun oʻz-oʻzini tartibga solishni targʻib qiladi. Ijrochi fikricha, yangi qonunchiliklar keraksiz, kompaniyalar toʻliq ishonch bilan xizmatlarni ishga tushirmaslik masʼuliyatini oʻz zimmasiga olishi kifoya.

