A Microsoft está desenvolvendo uma nova linha de processadores destinados à inteligência artificial. De acordo com a Reuters, a empresa tem planos de lançar o Maia 300 durante o segundo semestre, com possibilidade de ocorrer já em setembro, visando aumentar sua capacidade de produção interna e diminuir a dependência dos processadores fornecidos pela Nvidia.
Esta estratégia abrange também o setor de computação em nuvem. A Microsoft está em negociação com a TSMC para fabricar mais de 300 mil unidades deste novo chip, com previsão de entrega para 2027, e planeja aumentar consideravelmente esse volume.
A entrada da Microsoft no segmento de chips de IA ocorreu em novembro de 2023, com a apresentação do primeiro Maia. Desde então, concorrentes como Google e Amazon têm progredido na expansão de suas próprias soluções.
Este movimento visa mitigar a dependência dos processadores da Nvidia, ao mesmo tempo em que os chips desenvolvidos internamente das corporações ganham relevância no mercado de computação em nuvem. O Google já começou a registrar receita com a venda direta de seus chips de inteligência artificial, conhecidos como Tensor Processing Units (TPUs), enquanto a Amazon demonstra uma adoção crescente de seus processadores, incluindo o Trainium.
Mais especificamente, a Reuters informa que a Microsoft está negociando com a TSMC a produção de mais de 300 mil unidades do Maia 300, com entrega agendada para 2027. Além disso, a companhia pretende persuadir grandes clientes de computação em nuvem, como a Anthropic, a utilizarem este chip.
O objetivo de longo prazo estabelecido é assegurar capacidade para superar 1 milhão de unidades. Contudo, este plano pode ser restrito pela disponibilidade de componentes e pelos acordos de capacidade firmados com a TSMC.
Entre os aspectos centrais desta estratégia, destacam-se: o Maia 300 será o sucessor do Maia 200, a segunda geração introduzida pela Microsoft em janeiro. Este componente foi produzido pela TSMC utilizando tecnologia de 3 nanômetros. Adicionalmente, o chip foi equipado com uma quantidade substancial de SRAM, um tipo de memória que pode conferir benefícios de velocidade aos sistemas de IA que necessitam processar um grande volume de requisições de usuários.
