• Follow-Your-Click nimmt Bilder, die mit einfachen Texteingaben verbunden sind, und wandelt sie mit einem einzigen Klick in kurze Videoclips um.
  • Tencent hat mit Forschern von Universitäten in Hongkong und Peking zusammengearbeitet, vor dem Hintergrund wachsender Begeisterung für die KI-Videogenerierung.

UNSERE ANALYSE
Im Gegensatz zu ChatGPT kombiniert Tencent's Follow-Your-Click Bilder mit einfachen Texteingaben, die mit einem einzigen Klick in kurze Videoclips umgewandelt werden können.
Während andere Modelle von den Nutzern verlangen, detailliert zu beschreiben, wie und wo das Bild bewegt werden soll, ermöglicht Follow-Your-Click eine gezieltere Fokussierung auf bestimmte Elemente des Bildes.

-Jennifer YU, BTW-Reporterin

Der chinesische Internetriese Tencent Holdings hat am Freitag ein KI-Modell zur Bild-zu-Video-Umwandlung in Zusammenarbeit mit akademischen Partnern vorgestellt.

Follow-Your-Click

Das Bildanimationswerkzeug namens Follow-Your-Click wurde auf Microsofts Open-Source-Code-Plattform GitHub veröffentlicht, vor dem Hintergrund zunehmender Aufregung um Content-Generierungstools wie OpenAI's ChatGPT.

Das Projekt ist eine Zusammenarbeit zwischen Tencent's Hunyuan-Team, der Universität für Wissenschaft und Technologie Hongkong und der Tsinghua-Universität, einer der beiden besten Universitäten des chinesischen Festlands in Peking.

Auch lesen:ByteDances Gaming-Exodus: Gespräche mit Tencent gestalten die Branche neu

Funktionen

Follow-Your-Click ermöglicht es Nutzern, auf bestimmte Teile eines Bildes zu klicken und mit einer einfachen Texteingabe anzugeben, wie sie es bewegen möchten, um ein Standbild in ein kurzes animiertes Video zu verwandeln.

Tencent hat angekündigt, den vollständigen Code des Modells im April zu veröffentlichen, aber eine Demo ist bereits auf GitHub verfügbar.

Die Forscher präsentierten einige seiner Fähigkeiten, mit einem Ergebnis, das zeigt, wie ein Bild eines draußen stehenden Mädchens mit der einfachen Ein-Wort-Eingabe „Sturm“ in eine Animation mit Blitzen im Hintergrund umgewandelt wurde.

Laut einem wissenschaftlichen Artikel der Forscher der drei Organisationen zielt Follow-Your-Click darauf ab, das Problem anderer Bild-zu-Video-Modelle auf dem Markt zu lösen, die dazu neigen, die gesamte Szene zu bewegen, anstatt sich auf bestimmte Objekte im Bild zu konzentrieren.

„Unser Framework bietet eine einfachere, aber präzise Benutzersteuerung und eine bessere Generierungsleistung als frühere Methoden“, sagten die Forscher in dem am Mittwoch veröffentlichten Artikel.