- O Follow-Your-Click pega imagens associadas a simples instruções textuais e as transforma em pequenos clipes de vídeo com um único clique
- Tencent colaborou com pesquisadores de universidades de Hong Kong e Pequim em meio ao crescente entusiasmo em torno da geração de vídeo por IA
NOSSA OPINIÃO
Diferentemente do ChatGPT, o Follow-Your-Click da Tencent combina imagens com simples instruções textuais que podem ser convertidas em pequenos clipes de vídeo com um único clique.
Enquanto outros modelos exigem que os usuários descrevam detalhadamente como e onde mover a imagem, o Follow-Your-Click permite focar de forma mais específica em elementos particulares da imagem.
-Jennifer YU, repórter da BTW
O gigante chinês da internet Tencent Holdings apresentou na sexta-feira um modelo de inteligência artificial (IA) de imagem para vídeo em colaboração com parceiros acadêmicos.
Follow-Your-Click
A ferramenta de animação de imagens chamada Follow-Your-Click foi publicada no site de código aberto da Microsoft, GitHub, em meio ao crescente entusiasmo em torno de ferramentas de geração de conteúdo como o ChatGPT da OpenAI.
O projeto é uma colaboração entre a equipe Hunyuan da Tencent, a Universidade de Ciência e Tecnologia de Hong Kong e a Universidade Tsinghua, uma das duas melhores universidades da China continental em Pequim.
Leia também:O êxodo dos jogos na ByteDance: as conversas com Tencent remodelam a indústria
Funcionalidades
O Follow-Your-Click permite que os usuários cliquem em certas partes de uma imagem com uma simples instrução textual indicando como desejam movê-la, para transformar uma imagem estática em um curto vídeo animado.
A Tencent afirmou que publicará o código completo do modelo em abril, mas uma demonstração já está disponível no GitHub.
Os pesquisadores apresentaram algumas de suas capacidades, com um resultado mostrando como uma imagem de uma garota em pé ao ar livre com a simples instrução de uma palavra "tempestade" se transformou em uma animação com relâmpagos ao fundo.
De acordo com um artigo acadêmico dos pesquisadores das três organizações, o Follow-Your-Click visa resolver o problema encontrado por outros modelos de imagem para vídeo no mercado, que tendem a mover toda a cena em vez de focar em objetos específicos na imagem.
"Nosso framework oferece um controle de usuário mais simples, porém preciso, e melhor desempenho de geração do que métodos anteriores", disseram os pesquisadores no artigo publicado na quarta-feira.

