Компания NaiveAI представила модель Naive-N0.5-Flash с открытым весом на платформе Hugging Face. Эта модель представляет собой архитектуру Mixture-of-Experts (MoE), предназначенную для задач разработки программного кода и исследований в области искусственного интеллекта. Информация о модели была опубликована в середине или конце сентября 2026 года.
Официальное наименование продукта — NaiveAI / Naive-N0.5-Flash. Согласно технической документации, общая численность параметров составляет около 309 миллиардов, при этом активными являются 15,5 миллиарда весов. Модель распространяется под лицензией MIT и включает код для инференса, а также нативную поддержку контекстного окна в один миллион токенов.
Контекстная длина достигается за счет гибридного сочетания механизма Sliding-Window Attention (SWA) и легковесного DeepSeek Sparse Attention (DSA), который использует групповое внимание. Архитектура описывается как преимущественно соотношение SWA–DSA примерно 5:1, при этом в стеке отсутствуют полностью аттенционные слои. Модель базируется на открытой модели MiMo-V2.5, после чего проходит дообучение и посттренировку, а не полное предварительное обучение с нуля.
В части обслуживания, NaiveAI акцентирует внимание на NaiveRT — стеке для инференса, разработанном с использованием исследований, ориентированных на ИИ. Этот стек объединяет слияние мега-ядер (mega-kernel fusion), Программный Зависимый Запуск (Programmatic Dependent Launch) и спекулятивное декодирование. По данным вендора, скорость обработки достигает примерно 50 токенов в секунду на пользователя в Стандартном режиме и до 2000 токенов в секунду в Ультрабыстром режиме.
Теги на Hugging Face подчеркивают, что модель подходит для генерации текста для кода, работы с длинным контекстом и задач ИИ-исследований. Это соответствует заявленной концепции о том, что дообучение и посттренировка на сильной открытой базе могут продвинуть границы для агентов, занимающихся кодированием. Для разработчиков, сравнивающих китайские релизы MoE на этой неделе, Naive-N0.5-Flash является конкретным примером 309B / 15.5B MoE с гибридным контекстом в миллион токенов под лицензией MIT, представляя собой новость об архитектуре, а не о стоимости или запуске продуктов.



