Anthropic Claude tomonidan ishlab chiqarilgan matnlarga moʻljallangan koʻrinmas suv belgisi ishlashini tushuntirdi. Ushbu texnologiya Google DeepMind tomonidan ishlab chiqilgan SynthID-Text dan foydalanadi va javoblar generatsiya qilinayotgan jarayon davomida integratsiya qilinadi.
Bu tashabbusning asosiy maqsadi platforma tomonidan yaratilgan kontentni tekshirish usulini yaratish boʻlib, bu Yevropa Ittifoqi Sunʼiy intellekt Qonuniga muvofiqdir. Bu yevropa tartibi 2-avgustda kuchga kirdi va AI vositalari tomonidan yaratilgan kontent izlanishi mumkinligini talab qiladi, bu boshqa modellar uchun ham shunga oʻxshash texnologiyalarni joriy etishni koʻrsatadi.
Garchi SynthID video, rasm va audio kabi media turlariga suv belgilarini qoʻllash bilan tanilgan boʻlsa, inson koʻzi uchun sezilmaydigan nozik oʻzgarishlarni kiritib, SynthID-Text model tomonidan tanlangan soʻzlarning naqshini oʻzgartirish orqali ishlaydi, matn sifatiga zarar yetkazmaydi.
Belgi qanday ishlaydi?
Rasmiy bayonotda Anthropic yordamchi tomonidan yaratilgan soʻzlar asosida identifikatsiya ketma-ket qurilganini taʼkidladi. Til modellari oldingi kontekstni hisobga olgan holda har bir soʻzning statistik ehtimolini hisoblash orqali matnni quradi va aynan shu nuqtada suv belgisi faoliyat yuritadi.
Misol uchun, «Bugun ob-havo sovuq edi va...» kabi jumlada AI «shakarli» kabi ehtimoli past boʻlgan davomi haqida baholaydi, ammo u «bulutli» yoki «kulrang» boʻlishi mumkin. Sinonimlar uchun bir nechta imkoniyat mavjud boʻlganda, model qaysi soʻzni ishlatish boʻyicha tasodifiy qaror qabul qiladi. Suv belgisi joriy etilganda, kriptografik kalit ushbu tanlovni boshqarishni boshlaydi.
Keyinchalik, Claude topilgan naqshning oʻzi tomonidan yaratilgan matnga mos kelishini tahlil qiladi. Kompaniya bu Claude matn ichiga notoʻgʻri atamalarni kiritishni boshlaydi degani emasligini taʼkidlaydi, chunki Google DeepMind tomonidan oʻtkazilgan ichki sinovlar va SynthID-Text tadqiqotlari ushbu texnika yakuniy kontentga taʼsir qilmasligini koʻrsatdi.
Aniqlash qayerda xato berishi mumkin?
Belgi yozuv naqshi boʻyicha qoʻllanilgan usuli tufayli, Anthropic matndagi oddiy oʻzgarishlar tahlilga zarar yetkazishi mumkinligini va kontent tuzilishidagi sezilarli oʻzgarishlar belgilashni yoʻqotishiga olib kelishini koʻrsatadi.
Bundan tashqari, aniqlashda xatoliklar boʻlishi mumkin boʻlgan boshqa holatlar mavjud, masalan, parchalar juda qisqa boʻlganda, javob faktik va aniq maʼlumotga asoslanganda, matematik amallar, dasturlash kodlari yoki insonlar yozgan, ammo keyinchalik yordamchi tomonidan koʻrib chiqilgan matnlarda.
Nihoyat, Anthropic yaqinda aniqlash APIsini taqdim etishini eʼlon qildi, bu ishlab chiquvchilar, institutlar va platformalarga Claude tomonidan yaratilgan matnning ehtimoliy manbasini tekshirish imkonini beradi.

