A NaiveAI apresentou o modelo Naive-N0.5-Flash com pesos abertos na plataforma Hugging Face. Este modelo representa uma arquitetura Mixture-of-Experts (MoE), projetada para tarefas de desenvolvimento de código e pesquisas em inteligência artificial. As informações sobre o modelo foram publicadas em meados ou final de setembro de 2026.
O nome oficial do produto é NaiveAI / Naive-N0.5-Flash. De acordo com a documentação técnica, o número total de parâmetros é de cerca de 309 bilhões, sendo que 15,5 bilhões de pesos estão ativos. O modelo é distribuído sob a licença MIT e inclui código para inferência, além de suporte nativo a uma janela de contexto de um milhão de tokens.
O comprimento do contexto é alcançado através de uma combinação híbrida dos mecanismos Sliding-Window Attention (SWA) e DeepSeek Sparse Attention (DSA) leve, que utiliza atenção agrupada. A arquitetura é descrita como predominantemente uma proporção SWA–DSA de aproximadamente 5:1, sem camadas totalmente atencionais no stack. O modelo é baseado no modelo aberto MiMo-V2.5, passando por ajuste fino e pós-treinamento, e não por pré-treinamento completo do zero.
Em termos de serviço, a NaiveAI enfatiza o NaiveRT — um stack para inferência desenvolvido usando pesquisas orientadas para IA. Este stack combina fusão de mega-núcleos (mega-kernel fusion), Lançamento Dependente Programático (Programmatic Dependent Launch) e decodificação especulativa. Segundo o fornecedor, a velocidade de processamento atinge cerca de 50 tokens por segundo por usuário no Modo Padrão e até 2000 tokens por segundo no Modo Ultrarrápido.
As tags no Hugging Face destacam que o modelo é adequado para geração de texto para código, trabalho com contexto longo e tarefas de pesquisa de IA. Isso corresponde à concepção declarada de que o ajuste fino e o pós-treinamento em uma base aberta forte podem avançar os limites para agentes de codificação. Para desenvolvedores que comparam lançamentos chineses MoE nesta semana, o Naive-N0.5-Flash é um exemplo específico de MoE 309B / 15.5B com contexto híbrido de um milhão de tokens sob licença MIT, representando uma notícia sobre arquitetura, e não sobre custo ou lançamento de produtos.



