Anthropic oʻzining sunʼiy intellekt modellari xavfsizligini sinash uchun tashqi baholovchilarni integratsiya qildi
Batafsil
Olhar Digital
olhardigital.com.br

Anthropic oʻzining sunʼiy intellekt modellari xavfsizligini sinash uchun tashqi baholovchilarni integratsiya qildi

Anthropic eng ilgʻor sunʼiy intellekt (AI) tizimlarini ishlab chiqish surʼatini kamaytirish boʻyicha CEOsi Dario Amodei taklifini amalga oshirish uchun kompaniyaga tashqi baholovchilarni kiritish orqali aniq chorani qoʻlladi.

Birinchi tashqi baholovchi sifatida Accenture tanlandi. Bu hamkorlik Fakultetning (Accenturening AI boʻlimi) mutaxassislari Anthropic ichida ishlashiga va kompaniyaning xavfsizlik mexanizmlarini tekshirishiga imkon beradi. Faoliyatlar xavfsizlik choralari sinovlari, red team mashgʻulotlari va AI modellarining inson qiymatlariga rioya qilishini tasdiqlashga qaratilgan tahlillarni oʻz ichiga oladi.

Anthropic va Accenture kelasi besh yil ichida bu salohiyatni rivojlantirish uchun minimal 1 milliard AQSh dollari (taxminan 5,3 milliard BRL) investitsiya qildi. Biroq, Anthropic ushbu ishning shoshilinchligi va ahamiyati tufayli operatsiyalarni oʻzi moliyalashtirishini eʼlon qildi.

Uzoq muddatda kompaniya bunday faoliyatlarning davlat yoki umumiy mablagʻlar bilan moliyalashtirilishini kutmoqda, bu esa Anthropic tomonidan iyun oyida taqdim etilgan Kengaytirilgan AI Chegarasi (Advanced AI Framework) da bayon etilgan. Ushbu tuzilmalar hali yaratilmaganligi sababli, kompaniya turli baholovchilar va moliyalashtirish modellariga hamkorlik qilishni rejalashtirmoqda.

Amodeining taklifi mustaqil baholovchilarning AI kompaniyalari xodim darajasiga kirishiga ega boʻlishini nazarda tutardi. Buning maqsadi ushbu mutaxassislarga xavfsizlik amaliyotlarini bevosita tekshirish va har qanday hodisalarni hisobot berish imkonini berishdir.

Gʻoyasini taqdim etayotganda, Amodei Anthropic ushbu birinchi bosqichni «yakka tomonlama» oʻzi qabul qilishini taʼminladi va sohadagi boshqa korporatsiyalarni shunga oʻxshash pozitsiyani qabul qilishga undadi.

Boshqa hamkorliklar va masʼuliyat

Accenture bilan hamkorlik yagona boʻlmaydi; Anthropic METR nomli nonprofit tadqiqot tashkiloti va boshqa potentsial subʼektlar bilan hamkorlik qilish uchun aloqada ekanligini maʼlum qildi.

Biroq, kompaniya oʻz modellari xavfsizligi masʼuliyati butunlay oʻz zimmasida qolishini taʼkidladi va tashqi baholovchilarning mavjudligi bu burchni kamaytirmasligini bildirdi.

Anthropic quyidagicha izoh berdi: «Biz bu dastlabki saʼy-harakatlarni hozir baham koʻrmoqdamiz, toki odamlar va boshqa AI ishlab chiquvchilarimiz jarayonimizni koʻrishi mumkin boʻlsin». Kompaniya sohada yetuklashuvi bilan ushbu metodologiyani takomillashtirishni va ish boshlangach va koʻproq baholovchilar integratsiya qilingach yangi maʼlumotlarni yetkazishni rejalashtirayotganini qoʻshimcha qildi.

Accenture ishtirokida kompaniya Amodeining rejasi asosiy gʻoyalaridan birini funksional tuzilmaga aylantirish boʻyicha amaliy muhim qadam qoʻydi: tashqi subʼektning xavfsizlik tizimlarini audit qilish va muammolar kuchayishidan oldin ularni aniqlash uchun kompaniyaga bevosita kirishiga ruxsat berish.

Mashhur