طور باحثون صينيون تقنية جديدة قد تحدث تحولًا جذريًا في إنتاج فيديوهات الذكاء الاصطناعي، حيث تُسرع هذه التقنية الجديدة، المعروفة باسم "TurboDiffusion"، عملية توليد الفيديوهات بشكل كبير، بما يصل إلى 200 ضعف على نطاق واسع، دون المساس بجودة الصورة.
وتقلصت هذه التقنية الوقت اللازم لإنشاء مقطع فيديو قياسي مدته خمس ثوانٍ من أكثر من ثلاث دقائق إلى 1.9 ثانية فقط، أي تسريع يقارب 100 ضعف، عند اختبارها على جهاز مزود بوحدة معالجة الرسومات Nvidia RTX 5090. كما انخفض الوقت اللازم لإنشاء فيديو عالي الدقة مدته خمس ثوانٍ على نفس الجهاز من حوالي 80 دقيقة إلى 24 ثانية، أي أسرع بنحو 200 ضعف، وفقًا لإحدى التجارب المذكورة في الدراسة.
حاليًا، يستغرق إنشاء مقطع فيديو قياسي مدته خمس ثوانٍ على منصة "Vidu" التابعة لشركة Shengshu ما بين ثلاث وخمس دقائق. وكانت OpenAI قد ذكرت أيضًا أن نموذجها "Sora"، الذي يحوّل النصوص إلى فيديو، يستغرق عدة دقائق لإنتاج مقطع قصير. ويُبرز مشروع TurboDiffusion التقدم السريع الذي أحرزه الباحثون الصينيون في تطوير تقنية توليد الفيديو بالذكاء الاصطناعي منذ إطلاق OpenAI نموذج "Sora" في فبراير 2024.
اقرأ أيضاً
- الرئيس السيسى يستقبل كوشنر بالعلمين
- إيقاف جمع البلازما في كندا: تحقيق حكومي ووفيات متبرعين يثيران القلق
- محكمة أونتاريو العليا تسمح بإزالة مسارات الدراجات في تورونتو
- تحقيقٌ مع السفير الفرنسي في إفريقيا الوسطى بشأن مزاعم استضافة عشرات النساء
- تفشي إيبولا في الكونغو الديمقراطية يمتد إلى سادس محافظة وسط مخاوف من تجاوز الوباء الأشد فتكاً
ويمثل تسريع إنتاج الفيديو نقلة نوعية، حيث يُتوقع أن لا يُشكّل استخدام نماذج توليد الفيديو عائقًا أمام عملية الإنتاج. ويعزي الباحثون تسارع وتيرة توليد الفيديو إلى ابتكارات تدريب النماذج، بما في ذلك استخدام الانتباه الخطي المتقطع، حيث يركز نموذج الذكاء الاصطناعي على أهم أجزاء البيانات بدلاً من معالجتها دفعة واحدة. وهذا من شأنه أن يقلل وقت المعالجة وتكاليف الحوسبة بشكل كبير.
وقد أعلنت مؤسسة الذكاء الاصطناعي الأصلية (AI Native Foundation)، وهي منظمة تُعنى بتعزيز التكامل الشامل والعادل للذكاء الاصطناعي، في منشور على منصة "X" يوم الجمعة، أن تقنية "TurboDiffusion" تُمثل نقلة نوعية من مجرد "إمكانية التوليد" إلى "إمكانية التوليد الفوري"، مما يفتح آفاقًا جديدة لإنتاج فيديوهات الذكاء الاصطناعي في الوقت الفعلي عبر مختلف القطاعات.
وفقًا للمؤسسة، ستُمكّن "TurboDiffusion" الشركات من إنتاج فيديوهات على نطاق تجاري بتكلفة أقل وسرعة أكبر. كما تُعد هذه التقنية مثالية للمطورين "للتطبيقات التفاعلية والفورية"، وتُتاح "TurboDiffusion" بالكامل كمصدر مفتوح عبر منصة GitHub للمطورين.
أخبار ذات صلة
- طوكيو 2020: اختيار كيليتيلا لفريق اللاجئين الأولمبي هو تحقيق لحلم طال انتظاره
- الفرصة والأمل يلهمان لوهاليث قبل الظهور الأولمبي الثاني
- ثورة رسومية تضرب عروش الألعاب: DLSS 4 و Frame Generation يقتحمان الإصدارات الكبرى هذا الأسبوع
- لعبة Mindseye: طموحٌ اصطدم بواقعٍ تقني مُخذل
- مقلب أمازون الكبير: مشترٍ يتلقى معالجاً قديماً بدل أحدث إصدار من Ryzen بفارق أداء 40%