Anthropic koʻrinmas suv belgisi mexanizmining ishlashini eʼlon qilganidan biroz vaqt oʻtgach, dasturchilar ushbu belgini zaiflashtirish yoki yoʻq qilish imkoniyatiga ega deb iddia qilinadigan vositalarni taqdim etishni boshladilar.
Birinchi kod dasturchi Guillaume Meyer tomonidan ishlab chiqilgan va GitHubʼda yuz mingdan ortiq hissa qoʻshilishi bilan tezda mashhur boʻldi. Meyer X platformasida bu olib tashlovchini faqat tajriba sifatida yaratganini va uning maqsadi kontentni aniqlashga qarshi kurashish emas, balki suv belgisi metodologiyasiga qarshi kurashish ekanligini bildirgan.
Claude ning bu aniqlash mexanizmi Yevropa Ittifoqi Sunʼiy intellekt Qonuniga muvofiq joriy etilmoqda, u sunʼiy intellekt tomonidan yaratilgan kontentlarni belgilash majburiyatini belgilab qoʻygan. Hozirda taxminan yuz toʻqqizta tashkilot shartnomaga qoʻshilgan va matnli belgilash yil oxirigacha sohada standartga aylanishi kutilmoqda.
Anthropic ning suv belgisi soʻz tanlash jarayoni davomida belgilangan statistik standart orqali ishlaydi. Claude sinonimlar orasidan tanlash kerak boʻlganda, tizim bu qarorlarning bir qismini yoʻnaltirish uchun kalitdan foydalanadi, shu tariqa aniqlash mumkin boʻlgan imzo hosil qiladi.
Kompaniya oʻzi hatto eng kichik oʻzgartirishlar ham bu belgini zaiflashtirish potentsialiga ega ekanligini taʼkidladi. Aynan shu nuqtada Meyerning vositasi diqqatni jamlaydi: matn boshqa, xuddi shu belgilashni qoʻllamaydigan til modelidan foydalanib, hatto bir necha marta qayta yoziladi.
Sinonimlarni oʻzgartirish va gaplarni qayta tashkillashtirish asosidagi shunga oʻxshash jarayonlarni amalga oshiruvchi bir qator boshqa usullar tezda paydo boʻldi. Chunki aniqlash aniq standartga bogʻliq, bunday sozlamalar matn sintetik deb tasniflanish ehtimolini kamaytirish uchun yetarli boʻlishi mumkin, bu esa oddiy inson tekshiruvi bilan erishilishi mumkin.
Anthropic tomonidan qoʻllaniladigan texnologiya ikki yil avval Google DeepMind tomonidan nashr etilgan SynthID-Text usuliga asoslangan. Bu tizim 'past xavfli tanlovlarʼda ishlaydi: agar ikkita soʻz jumlada oʻxshash maʼnoga ega boʻlsa, AI oldindan belgilangan qoida boʻyicha ulardan birini tanlaydi. Maqsad oʻquvchi uchun matn tabiiy boʻlib qolishini saqlash, ammo ketma-ketlik kalitga ega boʻlganlar tomonidan aniqlanishi mumkin.
Anthropic oʻz tekshiruvi natijasi ehtimolni koʻrsatishini va matn toʻliq AI tomonidan yaratilganmi yoki faqat model tomonidan tahrirlanganmi aniq farqlay olmasligini tushuntiradi. Biroq, aynan shu turdagi tizimlarning potentsial 'xato ijobiy' natijalari dasturchilar va baʼzi mutaxassislar orasida xavotir uygʻotmoqda.
Taʼlim muassasalari, universitetlar, ishga qabul qiluvchilar yoki mijozlar baholashning faktik mezonlari sifatida aniqlagichlardan foydalanishlari mumkinligi haqida qoʻrquv mavjud, bu esa AI dan foydalanadigan yoki uni umuman ishlatmaydigan shaxslarga zarar yetkazishi mumkin.
Foydalanuvchilar tomonidan keltirilgan boshqa bir tanqid shundaki, ushbu texnologiyaning joriy etilishi Claude tomonidan ishlab chiqarilgan kontentning umumiy sifatini pasaytirishi mumkin, chunki natija belgilash standartiga rioya qilishi kerak. Yangi texnologiyani tavsiflashda Anthropic ichki testlar hech qanday sifati pasayishni koʻrsatmaganini taʼminlaydi.
