A Nvidia lançou o Nemotron 3.5 Lightning, um novo modelo de inteligência artificial aberto destinado a empresas que buscam reduzir os custos de processamento de tokens, mantendo acesso a recursos avançados. O anúncio foi feito na terça-feira (dia 11), em meio à contínua concorrência entre modelos de IA fechados e abertos.
Kari Briski, vice-presidente da Nvidia de software de IA generativa para empresas, explicou a estratégia da empresa durante o evento The Wall Street Journal Leadership Institute. Além do novo modelo de IA, a Nvidia lançou o Nemo Switchyard, uma biblioteca de código aberto que permite direcionar diferentes tarefas de agentes de IA para diferentes modelos.
O principal objetivo deste desenvolvimento é alcançar um equilíbrio entre velocidade, qualidade e custo, além de minimizar o risco de vazamento de informações confidenciais. O Nemotron 3.5 Lightning foi projetado com uma arquitetura mais compacta, mas mantém o conhecimento inerente a modelos mais poderosos, oferecendo às empresas uma alternativa menos custosa para certas tarefas.
Segundo Briski, a viabilidade econômica reside em evitar o uso de modelos maiores para executar operações rotineiras. O Switchyard complementa este conceito, decidindo qual modelo deve executar cada atividade com base em parâmetros como preço, tempo de processamento e qualidade da resposta.
Inicialmente, o sistema de roteamento foi desenvolvido pela própria Nvidia para atender às necessidades internas da empresa: gerenciamento eficiente do volume de tokens consumidos em aplicações de IA e manutenção do controle sobre sua propriedade intelectual. Além disso, ela enfatizou a proteção de informações corporativas. Para organizações que operam em áreas altamente especializadas, como cibersegurança e ciência dos materiais, existe a preocupação de compartilhar conhecimentos estratégicos com fornecedores de IA que podem se tornar concorrentes nesses mercados.
Briski observou que os modelos abertos dão às empresas maior flexibilidade, incluindo a capacidade de treinar com seus próprios dados. Para a Nvidia, isso se combina com a possibilidade de medir ganhos tanto em eficiência quanto em precisão.
Este passo ocorreu apenas um dia depois que a Meta Platforms lançou o Muse Glimmer, outro modelo aberto. A empresa descreveu a ferramenta como pequena o suficiente para rodar em um computador Mac ou PC equipado apenas com uma placa de vídeo de consumo.
A Nvidia também está ativamente envolvida na expansão da infraestrutura de IA. A empresa firmou acordos com Apollo, Blackstone, Goldman Sachs e KKR para criar plataformas de financiamento de capacidade computacional, visando fornecer aos clientes mais de US$ 500 bilhões em capital. No cenário industrial, também figura a Anthropic, que busca investidores antes de um potencial IPO de US$ 965 bilhões, bem como um contrato de 20 anos no valor de US$ 9,1 bilhões entre a empresa e a Riot Platforms para garantir capacidade de data center no Texas.
No setor de semicondutores, a Intel anunciou planos de levantar US$ 20 bilhões através de uma oferta pública de 210,5 milhões de ações a US$ 95 por ação. Anteriormente, a empresa havia declarado alta demanda por parte dos clientes relacionada ao aumento dos investimentos em capacidade computacional para inteligência artificial.



