ChatGPTning 2022-yilda ishga tushirilishi sunʼiy intellektlar uchun burilish nuqtasi boʻldi va ular internetdagi turli xil kontentlarda tobora koʻproq namoyon boʻldi. Pew Research Center tomonidan olib borilgan tadqiqot bu bayonotni tasdiqlash uchun maʼlumotlar taqdim etdi va OpenAI modelining kiritilishidan boshlab, roʻyxatdan oʻtgan har uchta saytdan biri maʼlum darajada AI elementlarini oʻz ichiga olganini, ayniqsa nashr etilgan matnlarda shuni aniqladi.
Bu soʻrov yangi havolalarni tahlil qildi va Katta Til Modellarining (LLM) javoblarida juda keng tarqalgan tilshunoslik xususiyatlariga ega sezilarli miqdordagi kontentni aniqladi. Ushbu xususiyatlarga qoʻshimcha ravishdan, tire (–) ning ortiqcha ishlatilishi, matn aniqligi uchun keraksiz deb hisoblangan Oxford vergulidan foydalanish va kontekst uchun haddan tashqari boy lugʻat boyligini kiritish kiradi.
TechCrunch tomonidan hisobot berilganidek, bu natijalar Cloudflare tomonidan oʻtkazilgan boshqa bir tadqiqotdan soʻng paydo boʻldi, u internetdagi bot trafikining inson foydalanuvchilarining trafikidan oshib ketganini koʻrsatgan edi, bu hodisa platforma tomonidan bashorat qilinganidan oldin sodir boʻlgan. Bu onlayn tadqiqotlarni amalga oshirayotgan va sunʼiy intellekt tomonidan yozilgan materiallarni isteʼmol qilayotgan AI sonining oshganligini bildiradi.
Pew Research Center tadqiqoti soʻnggi yillarda veb-saytlarda AI dan foydalanishni batafsil bayon etdi. Hozirda kuzatilayotgan oʻn mingta domenning kamida 10% AI ning biron bir hissasi bilan ishlab chiqarilgan. Muhim jihat shundaki, bu maʼlumot ChatGPTning 2022-yilda chiqarilishidan oldingi sahifalarni ham oʻz ichiga olgan umumiy dunyoni qamrab oladi. Biroq, yanada yaqinroq davrga eʼtibor qaratilganda, nashrlarning 35% yaratilishida sunʼiy intellektni oʻz ichiga olgani aniqlandi.
Pew tomonidan taqdim etilgan boshqa maʼlumotlar “.com” kengaytmasiga ega domenlarda AI ning 10% yuqori tarqalganligini koʻrsatadi. Biroq, LLM belgilari mavjud matnlar AQSh taʼlim muassasalari yoki hukumat organlari bilan bogʻliq boʻlgan “.edu” va “.gov” domenlarida ham aniqlangan. “.org” domenlari ham tekshirildi va sunʼiy intellekt yordami bilan yaratilgan mahsulotlarning 4,6% qayd etildi.
Taʼkidlash joizki, tahlil ingliz tilidagi kontentga cheklangan. Havolalar Common Crawl platformasi orqali toʻplangan va AI aniqlanishi Open Pangram vositasi yordamida amalga oshirildi. Garchi TechCrunch ushbu vosita aniqlashda xatoliklarga yoʻl qoʻyishi mumkinligini taʼkidlasa-da, tahlil qilingan sahifalar sonining katta hajmi tufayli makro darajada baholashga toʻsqinlik qilmaydi.
AI tomonidan yaratilgan nashrlar texnologiya ishlatilishini koʻrsatadigan oʻziga xos xususiyatlarga ega. Matnlar koʻpincha AI javoblarini yaratishdagi odatiy kamchiliklarni, masalan, tire (–) ning ortiqcha ishlatilishi, keraksiz vergullar va sirtqi xulosalar kabi, «shu, demak, u emas» kabi jumlalar bilan namoyon boʻladi.
Baʼzi uslublar baʼzi turdagi ishlab chiqarishda keng tarqalganligini eslatish muhim – masalan, jurnalistik maqolalarda – muallif gʻoyalarni tuzish uchun tirelardan foydalanishni afzal koʻrishi mumkin. Xuddi shu tarzda, ilmiy maqolalar va akademik nashrlar ham bunday kamchiliklarni oʻz ichiga olishi mumkin, shuningdek, eng koʻp maʼlumotni berish uchun tushuntirishlarni juda batafsil bayon qilishga moyil boʻlishi mumkin.
Farq bu kamchiliklarning qaysi kontekstlarda paydo boʻlishi bilan belgilanadi, ular odatda keraksiz tarzda qoʻllaniladi. Pew tadqiqoti bu tilshunoslik oʻziga xosliklarining chastotasining oʻsishini dalil sifatida koʻrsatadi: matnlarda ixtiyoriy vergullardan foydalanish 63% ga oshgan, AI javoblaridagi oddiy soʻzlar ikki barobar koʻpaygan va salbiy parallelizm uch marta koʻpaygan.
AI Slop holatlari faqat shu vaziyatda emas, balki internetda tobora koʻproq uchrayotgan. TB yaqinda AQSh Kongressidagi Qonuniy Maslahatchilar duch kelgan qiyinchiliklarni xabar qilgan edi, ular qonun loyihalarini AI xususiy kamchiliklari bilan tuzatish uchun katta vaqt sarflashadi. Shu bilan birga, LinkedIn kabi ijtimoiy tarmoqlar AI tomonidan yaratilgan nashrlar nisbatini kamaytirish orqali bu vaziyatni yumshatishga harakat qilyapti.
Sunʼiy intellekt kompaniyalari oʻzlari modellari tomonidan ishlab chiqarilgan kontentning massiv mavjudligi haqida xabardor va 2022-yildan oldin nashr etilgan bosma kitoblardan oʻzlarining AIlariga tobora koʻproq hajmlarda oʻquv materiallari sifatida foydalanmoqda. Bunga Cloudflare tadqiqoti ham qoʻshiladi, u bot trafikining inson qidiruvlarini ortda qoldirganini taʼkidlaydi.
