Anthropic Claude Fable 5.1 va Claude Mythos 5.1 ni yaxshilangan xususiyatlar va kamaytirilgan cheklovlar bilan chiqardi
Batafsil
Olhar Digital
olhardigital.com.br

Anthropic Claude Fable 5.1 va Claude Mythos 5.1 ni yaxshilangan xususiyatlar va kamaytirilgan cheklovlar bilan chiqardi

Anthropic kompaniyasi seshanba kuni (1-sentabr) oʻzining ilgʻor sunʼiy intellekt modellari liniyasining yangi versiyalari — Claude Fable 5.1 va Claude Mythos 5.1 ni taqdim etdi. Ushbu yangilanishlar samaradorlikni oshirish bilan birga, foydalanish xarajatlarini va Fable xavfsizlik mexanizmlari ishga tushish chastotasini kamaytiradigan oʻzgarishlarni birlashtiradi.

Fable 5.1 modeli keng jamoatchilik uchun moʻljallangan va Anthropic API orqali, shuningdek, bulutli hisoblash platformalarida mavjud. Mythos 5.1 esa, bir xil asosiy modeldan foydalansa ham, faqat kiberxavfsizlik va hayotiy fanlar sohasida tadqiqot olib boruvchi tanlangan Anthropic hamkorlari uchun mavjud.

Samaradorlikdagi yangi yutuqlar

Kompaniya yangi modellar dasturlash va bilimlarni qayta ishlash bilan bogʻliq vazifalarda yangi samaradorlik standartini belgilaganini taʼkidlaydi. Anthropic tomonidan eʼlon qilingan sinovlarga koʻra, Fable 5.1 AI agentlari tomonidan bajarilgan ilmiy tadqiqotlar uchun moʻljallangan Terminal-Bench-Science 0.1 testida 52,6% natija koʻrsatdi, bu Fable 5 ning 24,7% natijasidan sezilarli darajada yuqori.

Terminal-Bench 4.0 testida, u terminal orqali dasturlashga yoʻnaltirilgan, Fable 5.1 55,8% ga erishdi, bu Fable 5 ning 42% ga nisbatan. Shu bilan birga, Mythos 5.1 shu testda yanada yuqori natija — 60,9% koʻrsatdi. Bundan tashqari, yangi model OSWorld 2.0 testining qisman rejimida 77,9% va ushbu testning qattiqroq variantida 41,7% ni oldi. Humanityʼs Last Exam imtihonida Fable 5.1 vositalardan foydalanmasdan 60,9%, ulardan foydalanganda esa 65% koʻrsatdi.

Xavfsizlik mexanizmlarini va maxfiylikni yaxshilash

Muhim oʻzgarish xavfsizlik mexanizmlarida sodir boʻldi. Avvalgi Fable 5 tizimlar yuqori xavfli sohalar, ayniqsa kiberxavfsizlik sohasidagi potentsial bogʻliqliklarni aniqlaganda, qonuniy soʻrovlarni bloklash bilan tanqid qilingan edi. Anthropic Fable 5.1 bilan bu himoya funksiyalarini notoʻgʻri signal berishlarni minimallashtirish uchun takomillashtirganini eʼlon qiladi.

Kompaniya Fable 5.1 va Mythos 5.1 aslida bir xil model ekanligini va avvalgi testlardagi farqlarning baʼzilari aynan xavfsizlik tizimlarining aralashuvi bilan bogʻliq ekanligini tushuntiradi. Anthropic shuni koʻrsatadiki, bu himoyalar aralashganda, kiberxavfsizlik boʻyicha vazifalar maʼlum testlarda Claude Opus 4.8 ga, biologiklar esa Claude Opus 5 ga yoʻnaltiriladi, bu baʼzi baholashlarda Fable ning roʻyxatdan oʻtgan samaradorligini pasaytirishi mumkin edi.

Bundan tashqari, maxfiylik siyosatida sezilarli oʻzgarish kiritildi: Anthropic Zero Data Retention opsiyasini taklif qilishni boshladi. Bu mijozlarga modellar bilan oʻz infratuzilmalarida ishlash imkonini beradi va maʼlumotlar ushbu muhitlardan tashqariga chiqmasligini kafolatlaydi. Garchi tizim foydalanuvchilar yoki agentlar tomonidan mumkin boʻlgan suiisteʼmolni kuzatib borishda davom etsa-da, mijozlar bu monitoring qanday amalga oshirilishi ustidan koʻproq nazoratga ega boʻladi. Anthropic shuningdek, oʻz modellarini hech qachon korporativ maʼlumotlar asosida aniq ruxsatlarsiz oʻrgatmaganini va kelajakda ham bunday qilmasligini taʼkidladi.

Erta foydalanuvchilardan natijalar

Benchmarklardan tashqari, Anthropic Fable 5.1 ga dastlabki kirishni olgan kompaniyalar tomonidan olingan natijalarni oshkor qildi. Masalan, Millennium investitsion kompaniyasi model ularning ichki tizimlaridagi yillar davomida tushunilmagan juda kam uchraydigan uzilish sababini aniqlashga muvaffaq boʻlganini maʼlum qildi. Model tashqi kutubxonani tahlil qilib, kodni yadroli dump bilan solishtirib, bu kutubxonadagi muammoni uzilish manbai sifatida aniqladi.

MongoDB Fable 5.1 oʻz xizmatlari kodini va hujjatlarini oʻrganishi, murakkab prototip ishlab chiqishi va oʻz ishini baholash uchun oʻz-oʻzini tekshirish tsikllaridan foydalanib, nazoratsiz soatlarga qadar ishlashi mumkinligini bildirdi. Anthropic shuningdek, modellar rasmiy chiqarilishdan oldin ham ilmiy natijalar koʻrsatganini maʼlum qildi, jumladan, mavjud fotosuratlar asosida Veneraning yuqori aniqlikdagi xaritasini yaratish va GPU ni individual optimallashtirish.

Taraqqiyotga qaramay, Anthropicning ichki xavfsizlik hujjatlari Mythos 5.1 ning baʼzi nomuvofiqlik ssenariylarida Opus 5 ga qaraganda biroz yomonroq natija koʻrsatayotganini qayd etadi. Hujjatga koʻra, model notoʻgʻri foydalanish va avtorizatsiya bayonotlari bilan bogʻliq soʻrovlarni biroz osonroq qabul qiladi, ammo u oldingi modellariga qaraganda aniq cheklovlarga eʼtibor bermaslikka, kiritma maʼlumotlar ixtiro qilishga yoki vazifa yakunlanganligi haqida yolgʻon daʼvo qilishga kamroq moyil.

Mashhur