NaiveAI kompaniyasi Hugging Face platformasida ochiq ogʻirliklarga ega Naive-N0.5-Flash modelini taqdim etdi. Ushbu model Mixture-of-Experts (MoE) arxitekturasini tashkil etadi va dasturiy kodni ishlab chiqish hamda sunʼiy intellekt sohasidagi tadqiqotlar uchun moʻljallangan. Model haqidagi maʼlumot sentyabr 2026 yilning oʻrtasi yoki oxirida eʼlon qilindi.
Mahsulotning rasmiy nomi — NaiveAI / Naive-N0.5-Flash. Texnik hujjatlarga koʻra, umumiy parametrlar soni taxminan 309 milliardga yetadi, shu bilan birga faol boʻlgan ogʻirliklar 15,5 milliardni tashkil etadi. Model MIT litsenziyasi ostida tarqatiladi va inferens kodi, shuningdek, bir million tokenli kontekst oynasiga tabiiy qoʻllab-quvvatlashni oʻz ichiga oladi.
Kontekst uzunligi Sliding-Window Attention (SWA) mexanizmi va guruhli diqqatdan foydalanadigan yengil DeepSeek Sparse Attention (DSA) ning gibrid birlashmasi orqali erishiladi. Arxitektura asosan SWA–DSA nisbati 5:1 ga teng deb tasvirlanadi, bunda stackda toʻliq diqqat (fully attention) qatlamlari mavjud emas. Model MiMo-V2.5 ochiq modeliga asoslanadi, undan keyin toʻldirish va post-treningdan oʻtadi, noldan toʻliq oldindan oʻqitilmaydi.
Xizmat koʻrsatish nuqtai nazaridan, NaiveAI NaiveRT — AIga yoʻnaltirilgan tadqiqotlar asosida ishlab chiqilgan inferens stackiga urgʻu beradi. Ushbu stack mega-yadro birlashmasi (mega-kernel fusion), Dasturiy Bogʻliq Ishga Tushirish (Programmatic Dependent Launch) va spekulyativ dekodlashni birlashtiradi. Yetkazib beruvchining maʼlumotlariga koʻra, standart rejimda foydalanuvchi uchun qayta ishlash tezligi taxminan 50 token/sekund, Ultratez rejimda esa sekundiga 2000 tokengacha yetadi.
Hugging Faceʼdagi teglar modelning kod uchun matn yaratish, uzoq kontekst bilan ishlash va AI tadqiqotlari vazifalari uchun mos kelishini taʼkidlaydi. Bu, kuchli ochiq bazada toʻldirish va post-trening orqali kodlash agentlarini ilgari surish mumkinligi haqidagi bayonotga mos keladi. Bu hafta xitoy MoE nashrlarini solishtirayotgan ishlab chiquvchilar uchun Naive-N0.5-Flash MIT litsenziyasi ostidagi 309B / 15.5B MoE va million tokenli gibrid kontekstning aniq misolidir, bu mahsulot narxi yoki ishga tushishi haqida emas, balki arxitektura haqidagi yangilikdir.



