• Follow-Your-Click は、シンプルなテキスト指示と画像を組み合わせ、ワンクリックで短い動画クリップに変換します。
  • Tencent は、AI 動画生成への高まる関心を背景に、香港と北京の大学研究者と協力しました。

当サイトの見解
ChatGPT とは異なり、Tencent の Follow-Your-Click は画像とシンプルなテキスト指示を組み合わせ、ワンクリックで短い動画クリップに変換できます。
他のモデルでは、画像をどのように動かすか、どこを動かすかを詳細に説明する必要がありますが、Follow-Your-Click では画像の特定の要素に、より焦点を絞って操作できます。

- BTW レポーター Jennifer YU

中国のインターネット大手 Tencent Holdings は金曜日、大学との共同研究により、画像から動画を生成する人工知能(AI)モデルを発表しました。

Follow-Your-Click

Follow-Your-Click と呼ばれる画像アニメーションツールは、OpenAI の ChatGPT などのコンテンツ生成ツールへの注目が高まる中、Microsoft のオープンソースコードサイト GitHub で公開されました。

このプロジェクトは、Tencent の Hunyuan チーム、香港科技大学、そして北京にある中国本土のトップ 2 大学の一つである清華大学との共同研究です。

関連記事:ByteDance のゲーム事業撤退:Tencent との協議が業界を再定義

その機能

Follow-Your-Click は、ユーザーが画像の特定の部分をクリックし、どのように動かしたいかをシンプルなテキスト指示で指定することで、静止画を短いアニメーション動画に変換します。

Tencent は、モデルの完全なコードを 4 月に公開すると発表しましたが、GitHub にはすでにデモが公開されています。

研究者たちはそのデモで、機能の一部を紹介しました。たとえば、屋外に立つ少女の画像に「嵐」という一言の指示を与えると、背景に稲妻が走るアニメーションに変換される様子が示されています。

3 組織の研究者による学術論文によると、Follow-Your-Click は、市場に出回る他の画像から動画へのモデルが抱える問題、すなわち画像全体を動かす傾向があり、特定の物体に焦点を当てられないという課題を解決することを目的としています。」

「我々のフレームワークは、よりシンプルでありながら正確なユーザー制御を提供し、以前の手法よりも優れた生成パフォーマンスを実現します」と研究者たちは水曜日に公開された論文で述べています。