A Shengshu Technology anunciou hoje que a função de geração de imagens com base em referências do seu modelo de vídeo Vidu Q1 está oficialmente disponível para usuários públicos. A lançamento desta função visa superar os gargalos da tecnologia de consistência entre múltiplos sujeitos, fechar o ciclo da cadeia produtiva comercial de geração de imagens e vídeos por meio da IA, e impulsionar a criação multimodal da IA para uma nova fase.

O lançamento da função de geração de imagens com base em referências do Vidu Q1 se concentra nos "cinco diferenciais". Primeiro, ele suporta a entrada de até 7 imagens de referência simultaneamente, aumentando significativamente o controle durante o processo criativo. Segundo, o Vidu Q1 demonstra maior consistência na capacidade de geração de múltiplos sujeitos e cenários, garantindo que as aparências e características dos personagens e sujeitos permaneçam consistentes mesmo em várias gerações, assegurando alta fidelidade e realismo. Além disso, os usuários podem trocar roupas e fundos livremente com apenas uma imagem e uma frase de instrução, permitindo uma criação de alto grau de liberdade.
A Shengshu Technology afirmou que a era das imagens de referência múltiplas do Vidu Q1 marca uma grande ruptura na tecnologia de consistência, permitindo aos usuários criar com flexibilidade em cenários complexos e aumentando o realismo e a aplicabilidade da geração de imagens. Ferramentas de criação AI anteriores eram principalmente para estimular a inspiração, enquanto o Vidu Q1 expandiu o papel da IA para ser o principal responsável pela produção de conteúdo, permitindo que os usuários apenas supervisionem, reduzindo significativamente a barreira para a produção de conteúdo.

Em termos de aplicações específicas, o Vidu Q1 oferece três modos de geração: síntese, substituição e transformação. Por exemplo, os usuários podem sintetizar diferentes pessoas em um mesmo cenário ou substituir o fundo de uma foto existente por um novo cenário, gerando facilmente conteúdo personalizado. Além disso, esta ferramenta tem grande potencial de aplicação nas áreas de design de roupas, propaganda publicitária e marketing criativo, ajudando designers e comércio eletrônico a produzir rapidamente materiais de alta qualidade.
O recente inovação da Shengshu Technology marca um novo marco na aplicação comercial de ferramentas de geração de imagens por IA. A empresa espera que esta tecnologia avançada impulsona a nova era da criação multimodal para mais empresas e usuários individuais no setor, realmente realizando o objetivo de empoderar a produtividade por meio da tecnologia da IA.




