Anthropic sunʼiy intellekt rivojlanishi bilan bogʻliq mavjud boʻlgan mavjud boʻlmagan xavflar haqida potentsial investorlarga ogohlantirmoqda
Batafsil
Business Standard
business-standard.com

Anthropic sunʼiy intellekt rivojlanishi bilan bogʻliq mavjud boʻlgan mavjud boʻlmagan xavflar haqida potentsial investorlarga ogohlantirmoqda

Anthropic kompaniyasi aksiyalar birinchi jamoatchilik sotuvlari (IPO) prospektiga ilgʻor sunʼiy intellekt insoniyat uchun «fojiali yoki mavjud boʻlmagan xavflarni keltirib chiqarishi mumkin» degan ogohlantirishni kiritdi. Bu bayonot shu texnologiyadan foyda olishga intilayotgan kompaniya uchun gʻayritabiiy hisoblanadi.

Reuters tahlil qilgan IPO prospektiga koʻra, kompaniya oʻzining AI modellariga bogʻliq xavflarni yoritdi. Ushbu modellar «oʻzini saqlashga yoʻnaltirilgan xatti-harakatlarni», jumladan «oʻchirishga qarshilik koʻrsatish», «maʼlumotni yashirish yoki manipulyatsiya qilish» va shantaj qilishga oʻxshab harakat qilish urinishlarini namoyish etishi mumkinligi qayd etildi.

Hujjatda Anthropic quyidagilarni taʼkidladi: «Bizning yuqori darajadagi modellar, platformalar va ilovalarni rivojlantirish va ularning qoʻllanilish imkoniyatlarini kengaytirish bizning modellarimiz zarar yetkazishi ehtimolini yanada oshirishi mumkin». Kompaniya AI ning sanoatlashuv va elektr energiyasi bilan taqqoslanadigan transformatsion salohiyatini ham, ushbu texnologiyadan notoʻgʻri foydalanish natijasida yuzaga kelishi mumkin boʻlgan qaytarib boʻlmaydigan zararni ham taʼkidladi.

Anthropic, OpenAI kabi boshqa AI ishlab chiquvchilari singari, eksperimental tizimlar belgilangan cheklovlarni buzgan holatlar keyinidan diqqat jalb qildi. Misol sifatida OpenAI modeli Avstraliya sogʻliqni saqlash tizimi maʼlumotlar bazasiga kirishiga oid xabar keltirilgan.

Anthropic xavfsizlik tadqiqotchisi Evan Hubinger AI tufayli keyingi oʻn yilda odamlarning halok boʻlish ehtimolini 10 foizdan ortiq baholadi, bu sobiq hamkasbi Jacob Coxning fikriga mos keladi.

Yuqori xavfli maʼlumot berish

Oʻzini xavfsizlikka yoʻnaltirilgan AI laboratoriyasi sifatida pozitsiyalashgan kompaniya asosiy 261 sahifalik prospektining taxminan 80 sahifasini xavf omillarini tasvirlash uchun ajratgan. Bu uning biznesini tavsiflashga bagʻishlangan 48 sahifadan deyarli ikki barobar koʻproq. Taqqoslash uchun, xAI egaligidagi SpaceX oʻzining 277 sahifalik prospektining asosiy qismidan faqat taxminan 38 sahifani xavf omillariga ajratgan.

Anthropic prospektida «modellarimizni baholash boʻyicha harakatlarimizning potentsial ongli holati modellar xavfsizligini baholash qobiliyatimizga sezilarli cheklov qoʻyadi» deb koʻrsatilgan. Bundan tashqari, modellar oʻqitilayotganda baʼzan kutilmagan imkoniyatlarga ega boʻlishi mumkin, ular faqat joriy etilgandan soʻng namoyon boʻlib jiddiy xavfsizlik hodisalariga olib kelishi mumkin.

AI tadqiqotchilari shuningdek, modellar imkoniyatlari ortishi bilan ular tomonidan kuzatilayotganini tobora koʻproq anglab yetishayotganini va oʻz xatti-harakatlarini tegishli tarzda sozlayotganini ogohlantiradilar, bu esa ularning harakatlarini monitoring qilishni qiyinlashtiradi.

AI xavfsizligiga urgʻu berilganiga qaramay, Anthropic investitsiyalar natijalari noaniq ekanligini maʼlum qildi. Prospektda kompaniya bunday tadqiqotlarga qancha mablagʻ sarflanayotgani haqida maʼlumot bermadi. Ushbu oy boshida Anthropic AI tadqiqotlari uchun ishlatilayotgan hisoblash quvvatining taxminan 6 foizi iyul oyidagi namuna haftada xavfsizlik ishlari uchun yoʻnaltirilganini maʼlum qilgan edi.

Claude AI modellarining yaratuvchisi boʻlgan Anthropic xavfsizlikni taʼminlash saʼy-harakatlarini «resurs talab qiluvchi» deb atadi va cheklangan mablagʻlarni hisoblash quvvati, qimmatbaho AI isteʼdodlari va xavfsizlik oʻrtasida taqsimlash zarurligini taʼkidladi.

Kompaniya mijozlaridan olinadigan daromad uning yangi modellaridan kelib chiqishini va «uzluksiz va kesishuvchi surʼat» AI rivojlanishida yetakchilikni saqlab qolishning ajralmas qismi ekanligini bildirdi.

Kompaniya oʻtgan hafta oʻzining Opus modelining yangi versiyasini chiqarib berdi, bu Bosh ijrochi Dario Amodei taxminan 4000 soʻzlik inshoni nashr etganidan 10 kun oʻtgach sodir boʻldi, unda texnologiya rivojlanish surʼatini sekinlashtirish chaqirigʻi bor edi. Baʼzi tahlilchilar va ekspertlar hech bir yetakchi AI laboratoriyasi surʼatni sekinlashtirmasligini taxmin qilishadi, chunki bu qiymat bahosi har bir chiqarilish bilan oʻzgarishi mumkin boʻlgan sanoatda raqobatchilarga ustunlik berishi mumkin.

Anthropic soʻnggi haftalarda AI modellarini kelajak avlod texnologiyasini yaratish uchun qanday ishlatishiga haqida koʻproq ommaviy maʼlumot berishga vaʼda berdi, chunki ekspertlar rekursiv oʻz-oʻzini takomillashtirish — modellar inson yordamisiz mustaqil rivojlanishi mumkin boʻlgan nuqta haqida ogohlantirmoqda. Kompaniya prospektida quyidagicha yozilgan: «Biz ishonchli, ishonchli va xavfsiz AI tizimlarini yaratish kollektiv masʼuliyat deb hisoblaymiz va bozor buni mukofotlaydi».

Mashhur