A Alibaba lançou nesta segunda-feira (24) o Wan3.0, seu mais recente modelo de geração de vídeo com inteligência artificial, que traz melhorias na duração do vídeo, criação de propósito geral, gerenciamento de referências e reconstrução do mundo real.
Em seu site, a Alibaba Cloud, serviço de nuvem da empresa, destaca que o modelo pode gerar vídeos de 30 segundos em uma única execução, o dobro do limite de 15 segundos do seu antecessor.
Ele, além de entradas de texto, imagem, áudio e vídeo, lê documentos — doc, xls, ppt, pdf, txt, key, pages, numbers e md (1 arquivo ou link, ≤100MB, ≤50 páginas).
Também permite, durante a edição, modificar os elementos visuais, o enredo e os diálogos sem precisar recomeçar do zero.
Outra característica, como destaca a companhia, é que o Wan3.0 mantém os detalhes dos personagens, adereços, layout espacial e animações gráficas estáveis durante toda a duração do vídeo, bem como renderiza rostos com microexpressões sincronizadas e saída de voz multilíngue.
Reportagem da Reuters relata que o modelo tem sido usado na produção de curtas-metragens e filmes, publicidade e marketing, promoção turística e criação de videoclipes desde o lançamento de uma versão beta pública em 6 de agosto.
O The Next Web acrescenta que o acesso ainda está sendo feito em etapas, e não de forma aberta.
A versão beta é executada por meio do Model Studio e do Qwen Cloud, com base em aplicativos.
A disponibilidade completa da API está sendo descrita como gradual, e um site voltado para o consumidor em wan.video é prometido como uma plataforma exclusiva para membros.
O lançamento do Wan3.0, que custa US$ 0,05 por segundo em 480p, US$ 0,10 em 720p e US$ 0,20 em 1080p, se deu um dia depois de a Alibaba anunciar uma oferta de ações no valor de US$ 10,2 bilhões (aproximadamente R$ 52,5 bilhões) com um grande desconto para financiar suas ambições em inteligência artificial.
Trata-se da maior oferta subsequente de ações (follow-on) por uma empresa cotada em Hong Kong.
Mais Lidas
