Anthropic sunʼiy intellekt rivojlanishidagi taraqqiyotni kuzatish uchun uchta metrikani taqdim etdi
Batafsil
Olhar Digital
olhardigital.com.br

Anthropic sunʼiy intellekt rivojlanishidagi taraqqiyotni kuzatish uchun uchta metrikani taqdim etdi

Anthropic bu beshanba kuni, 17-sarda, sunʼiy intellekt (SI) qanchalik tez rivojlanayotganini kuzatishga moʻljallangan yangi uchta koʻrsatkichni eʼlon qildi. Ushbu tashabbus kompaniya Bosh ijrochi direktori Dario Amodei sektorning yirik korporatsiyalari texnologik taraqqiyotni moderatsiya qilish boʻyicha muvofiqlashishi kerakligini himoya qilganidan biroz vaqt oʻtgach paydo boʻldi.

Kompaniya shuningdek, uning Claude chatbotining ichki SI Tadqiqot va Ishlab chiqarish (T&I) ishlarining 26% uchun masʼul boʻlganini oshkor qildi. Anthropicning maʼlumotlariga koʻra, bu taraqqiyot oʻzining evolyutsiyasiga asta-sekin hissa qoʻshadigan tizimlarni oʻlchashga yordam beradi.

Claude ishtirokining ortishiga qaramay, Anthropic model hali oʻlchanayotgan T&I ning hech bir qismida toʻliq mustaqil faoliyat yuritmasligini tushuntirdi. Bu kontekstda 'yetakchilik' deganda Claude yuqori darajadagi yoʻriqnoma asosida butun vazifaning katta qismini bajarishi, ammo umumiy nazorat va yoʻnaltirish uchun inson masʼul boʻlishi tushuniladi. Ushbu koʻrsatkich fevral oyida nol edi.

Bundan tashqari, Anthropic SI kamida 90% tadqiqotlarining yaqin inson nazorati ostidagi ishlarining katta segmentlariga kirib borayotganini maʼlum qildi, bunga Claude yetakchi sifatida qaraladigan 26% ham kiradi.

Bu koʻrsatkichni hisoblash uchun Anthropic kompaniyaning T&I ni baholashda Claude ning oʻz versiyasidan foydalangan. Tizim Epoch AI tomonidan yaratilgan avtomatlashtirish baholash miqyosiga qoʻllanilgan va natijalar keyinchalik odamlar tomonidan tasdiqlangan. Kompaniya shuningdek, 2025-yil avgust oyidan boshlab Claude ning avtomatlashtirish darajasini kuzatish uchun grafik ishlab chiqdi va boshqa ilgʻor modellarni ishlab chiquvchilarga oʻz maʼlumotlari va tashqi tasdiqlashdan foydalanib ushbu usulni takrorlashni taklif qildi.

Anthropic tomonidan taqdim etilgan ikkinchi metrika SI agentlarini nazorat qilishga qaratilgan. Kompaniya ushbu agentlarning harakatlarini kuzatish va ularga aralashish uchun tizim ishlab chiqdi va eng koʻp ishlatiladigan ichki platformasida bir vaqtning oʻzida taxminan 30 ming agent muhandislik va tadqiqot ishlarini bajarayotganini kuzatdi. Kompaniya shuningdek, shubhalik faoliyatni aniqlash va uni inson tahliliga yoʻnaltirishga qodir bir nechta ichki avtonom monitorlardan foydalanadi. Anthropicning maqsadi faqat faol agentlar hajmini emas, balki kuzatilayotgan faoliyat nisbati, harakatni koʻrib chiqish uchun zarur boʻladigan vaqt va agent xatti-harakatlari qancha tez-tez signal berilishi kabi jihatlarni ham oʻlchashdir.

Koʻproq oʻqing:

Uchinchi metrika tashkilot tomonidan sarflanadigan kompyuter quvvati miqdoriga tegishli. 13 va 20-iyul oraligʻidagi kompyuterdan foydalanish holatini tahlil qilganda, Anthropic SI T&I ga ajratilgan kompyuter quvvatining taxminan 6% xavfsizlik vazifalariga ajratilganini aniqladi. SI tomonidan 'qoʻllab-quvvatlangan' T&I da foydalanilgan kompyuter quvvatini hisobga olsak, xavfsizlikka ajratilgan bu ulush taxminan 12% ga yetdi. Anthropic uchun bunday maʼlumotlar kompaniyalar tobora murakkabroq modellarni ishlab chiqishda oldinga siljishayotgan sari resurslar qanday taqsimlanayotganini koʻrsatishga yordam beradi.

Anthropic bu uchta metrikaning modellarning anʼanaviy quvvat baholarini toʻldirishi kerakligini taʼkidlaydi. Quvvat sinovlari modellarning nimalarni qila olishini namoyish etsa, yangi metrikalar ular qanday qurilayotganini va jarayon surʼatini koʻrsatishga qaratilgan. Kompaniya bunday maʼlumotlar tashqi tadqiqotchilar, hukumatlar va jamoatchilikka eng muhim SI laboratoriyalaridagi rivojlanish surʼatini baholash uchun boshlangʻich nuqta berishi mumkinligini himoya qiladi.

Anthropic har qanday ilgʻor ishlab chiquvchi bu oʻlchovlarni ochiq metodologiyaga amal qilgan holda muntazam ravishda chop etishi mumkinligini eʼlon qildi. Kompaniya maʼlumotlarni oshkor qilishni shaffoflikni oshirish, jamoatchilik, uchinchi tomonlar va hukumatlar uchun ilgʻor laboratoriyalardagi SI rivojlanish surʼati haqida taʼminlashini dalil qildi. Bu oshkor qilish Amodei SI rivojlanishining muvofiqlashgan sekinlashuvini himoya qilganidan soʻng sodir boʻldi.

Ijrochi korxonalar yetakchilari xavfsizlik mexanizmlarini yaratish uchun koʻproq vaqt berish maqsadida surʼatni pasaytirishlari kerakligini taʼkidladi. Ushbu taklif OpenAI Bosh ijrochi direktori Sam Altman, SpaceX Bosh ijrochi direktori Elon Musk va Google DeepMind prezidenti Demis Hassabis kabi sektor liderlari tomonidan qoʻllab-quvvatlandi. Amodei oʻz reja-sxemasi AQShning SI sohasidagi tijorat ustunligi yoki yetakchiligini buzmasdan modellarning imkoniyatlari evolyutsiyasining surʼatini nazorat qilishni maqsad qilganini aytdi.

Shuning bilan birga, SI tizimlari tushunarsiz yoki nazorat qilib boʻlmaydigan holatga kelishi xavfi haqidagi mutaxassislar va ijrochi shaxslarning ogohlantirishlaridan soʻng xavfsizlik boʻyicha munozara kuchaydi. Oldingi hafta Anthropicning sobiq xodimi kompaniyadan ketib, u yerda ular 'bizning hayotimiz bilan tiksilmoqda' deb aytgan. Muhokama Washington (AQSh) ga ham yetib bordi, u yerda senator Bernie Sanders SI ning inson nazoratidan chetga chiqishi xavfi haqidagi tadbirda ishtirok etdi. Anthropic va OpenAI kabi raqobatchilar oʻz ichki agentlari sinovlar va vazifalar davomida kutilganidek xatti-harakat qilishini kafolatlash boʻyicha yanada koʻproq nazorat ostida qoldi. Chorshanba kuni (16-sanba), OpenAI vazifalarda muvaffaqiyatsizlikka uchragan yoki belgilangan skriptdan chetga chiqqan SI agentlarining yangi misollarini eʼlon qildi va bunday hodisalarni yetkazish uchun tuzilmani taqdim etdi. Bu kontekstda, Anthropic oʻzining yangi metrikalari SI ning keyingi avlodni ishlab chiqish ishlarining tobora koʻproq qismini oʻz zimmasiga oladigan Claude kabi tizimlar bilan texnologik taraqqiyot koʻrinishini oshirishi mumkinligini koʻrsatadi.

Mashhur