Kling AI apresenta o modelo Kling 4.0 com capacidade de gerar clipes de 30 segundos e controle múltiplo
Leia mais
Pandaily
pandaily.com

Kling AI apresenta o modelo Kling 4.0 com capacidade de gerar clipes de 30 segundos e controle múltiplo

A empresa Kuaishou apresentou seu novo modelo de vídeo Kling 4.0 em 28 de setembro e, no mesmo dia, liberou acesso limitado à versão mais leve, Kling 4.0 Flash. O acesso ao Flash é inicialmente concedido aos assinantes Ultra Yearly, enquanto o modelo completo está previsto para ser lançado em outubro, embora a data exata ainda não tenha sido anunciada.

A principal melhoria reside na duração do vídeo: o Kling 4.0 é capaz de gerar até 30 segundos de vídeo em uma única passagem, o que dobra o limite anterior de 15 segundos do Kling 3.0. Este recurso suporta planos longos e narrativa contínua dentro de um único clipe. Além disso, em breve haverá um recurso de extensão de vídeo, permitindo que os usuários continuem o clipe várias vezes, atingindo uma duração de cerca de dois minutos.

Controle de Geração e Edição

Outro foco foi dado à capacidade de gerenciamento do processo. Uma tarefa agora pode combinar até 15 links multimodais, que podem ser retirados de 10 imagens, cinco clipes de vídeo e sete objetos. Isso permite que personagens, movimentos, trabalho de câmera e som sigam com mais precisão o material fornecido. Os usuários também podem definir até 10 quadros-chave para fixar estados de personagens, mudanças de cena e momentos da trama.

A entrada de prompts de texto foi aumentada para 8000 tokens, dando ao modelo a capacidade de expandir e refinar prompts curtos. As ferramentas de edição permitem adicionar, modificar ou remover objetos e fundos em vídeos já existentes, bem como ajustar estilo, clima, cor, material, tamanho do quadro ou ângulo. O modo de reformulação analisa as características linguísticas e o ritmo do vídeo de referência para criar um novo comercial nessa estrutura, focado em redes sociais, publicidade de produtos, moda, beleza e eletrônicos de consumo.

Em termos de qualidade de saída, o Kling 4.0 suporta formatos 4K e 1080p com HDR de 10 bits, o que também deve estar disponível em breve. Adicionalmente, há suporte para o formato ultra largo 21:9, áudio estéreo de dois canais e sincronização labial aprimorada. A empresa afirma que o movimento, os planos de rastreamento e os movimentos rotativos da câmera se tornaram mais estáveis. O suporte de voz abrange chinês, inglês, japonês, coreano, espanhol, português, alemão, francês e hindi, incluindo sotaques de inglês americano, britânico e indiano, bem como vários dialetos chineses, como cantonês. O modelo também é capaz de exibir texto multilíngue, emojis e logotipos na tela.

A versão Kling 4.0 Flash é destinada à criação de conteúdo de alto volume devido à geração mais rápida e custo reduzido. A Kuaishou também atualizou a página de criação, unificando links para imagens, vídeos e áudio em um único campo de entrada, adicionando uma linha do tempo para pré-visualização e edição, e uma área de trabalho de tela com um agente assistente. Os preços da API para o novo modelo ainda não foram publicados.

Histórias semelhantes

Inspur apresenta o supernó MetaBrain SD200 Ultra com 128 chips domésticos para trabalhar com o modelo Kimi K3
Leia mais
pandaily.com

Inspur apresenta o supernó MetaBrain SD200 Ultra com 128 chips domésticos para trabalhar com o modelo Kimi K3

A Inspur Information apresentou o supernó de inteligência artificial MetaBrain SD200 Ultra na conferência de computação em inteligência artificial AICC2026. Este nó é posicionado como um sistema de classe de capacidade para processar tarefas com trilhões de parâmetros e agentes. O nome oficial em inglês do sistema é Inspur / MetaBrain.

De acordo com os dados da empresa e agências de informação, o nó combina 128 chips de IA domésticos, fornece acesso a 8 TB de memória unificada do acelerador e 64 TB de memória host. Ele é capaz de executar o modelo Kimi K3 da Moonshot AI, que possui 2,8 trilhões de parâmetros, em uma única máquina com latência de geração de token inferior a 5,85 milissegundos, o que equivale a cerca de 170 tokens por segundo para um único usuário, segundo estimativas da Inspur.

As características arquitetônicas do nó incluem a fábrica 3D Hyper Mesh, que garante comunicação nativa sensível à semântica da memória, com latência declarada de 0,69 microssegundos. Também são utilizados interconexões de cobre de curto alcance e memória simétrica, permitindo que os aceleradores acessem diretamente a memória de nós remotos. A Inspur afirma que o tempo de execução da operação AllReduce foi reduzido em aproximadamente 3,5 vezes em comparação com soluções anteriores.

Além disso, os 'superoperadores' integrados para as etapas KDA, gated MLA e MoE do modelo Kimi K3 reduzem o número de operadores em cerca de dez vezes, ao mesmo tempo que aumentam o desempenho de inferência em mais de três vezes. Esses indicadores são declarações do fornecedor. Os materiais também indicam o potencial de suporte a modelos de até 10 trilhões de parâmetros em um único nó.

Outro produto, o MetaBrain HC2000, é um rack com vários aceleradores destinado à inferência de classe de capacidade, com uma taxa de transferência de tokens por investimento declarada de dez vezes, desde que os limites acordados do SLA sejam respeitados. Embora várias publicações descrevam os aceleradores apenas como chips de IA domésticos ou locais, nenhuma das fontes principais analisadas para esta revisão nomeia o fabricante do silício ou o SKU dentro do SD200 Ultra. Portanto, este artigo não atribui o nó a Ascend, Cambricon ou a qualquer outro fornecedor específico.

Popular