• Follow-Your-Click يأخذ الصور المرتبطة بأوامر نصية بسيطة ويحولها إلى مقاطع فيديو قصيرة بنقرة واحدة.
  • تعاونت Tencent مع باحثين من جامعات هونغ كونغ وبكين وسط حماس متزايد حول توليد الفيديو بالذكاء الاصطناعي.

رأينا
على عكس ChatGPT، يجمع Follow-Your-Click من Tencent بين الصور وأوامر نصية بسيطة يمكن تحويلها إلى مقاطع فيديو قصيرة بنقرة واحدة.
بينما تتطلب النماذج الأخرى من المستخدمين وصف كيفية وأين تحريك الصورة بالتفصيل، يسمح Follow-Your-Click بالتركيز بشكل أكثر تحديدًا على عناصر معينة من الصورة.

-جينيفر يو، مراسلة BTW

أطلق عملاق الإنترنت الصيني Tencent Holdings يوم الجمعة نموذجًا للذكاء الاصطناعي لتحويل الصور إلى فيديو بالتعاون مع شركاء أكاديميين.

Follow-Your-Click

أداة تحريك الصور المسماة Follow-Your-Click نُشرت على موقع مايكروسوفت مفتوح المصدر، GitHub، وسط حماس متزايد حول أدوات توليد المحتوى مثل ChatGPT من OpenAI.

المشروع عبارة عن تعاون بين فريق Hunyuan من Tencent، وجامعة هونغ كونغ للعلوم والتكنولوجيا، وجامعة تسينغهوا، إحدى أفضل جامعتين في البر الصيني الرئيسي في بكين.

اقرأ أيضًا:هجرة ألعاب الفيديو في ByteDance: المحادثات مع Tencent تعيد تشكيل الصناعة

ميزاته

يسمح Follow-Your-Click للمستخدمين بالنقر على أجزاء معينة من الصورة مع أمر نصي بسيط يوضح كيف يريدون تحريكها، لتحويل صورة ثابتة إلى فيديو متحرك قصير.

أعلنت Tencent أنها ستنشر الكود الكامل للنموذج في أبريل، لكن العرض التوضيحي متاح بالفعل على GitHub.

قدم الباحثون بعض قدراته، مع نتيجة تظهر كيف تحولت صورة لفتاة واقفة في الخارج بأمر نصي بسيط مكون من كلمة واحدة 'عاصفة' إلى رسم متحرك مع برق في الخلفية.

وفقًا لمقال أكاديمي للباحثين من المنظمات الثلاث، يهدف Follow-Your-Click إلى حل المشكلة التي تواجهها نماذج تحويل الصور إلى فيديو الأخرى في السوق، والتي تميل إلى تحريك المشهد بأكمله بدلاً من التركيز على كائنات محددة في الصورة.

قال الباحثون في المقال الذي نُشر يوم الأربعاء: 'إطار عملنا يوفر تحكمًا أبسط وأكثر دقة للمستخدم وأداء توليد أفضل من الطرق السابقة'.