ووفقًا لما نُشر على مدونة علي بابا، يستطيع Wan 3.0 تحويل النصوص والصور والفيديوهات والملفات الصوتية، وحتى المستندات، إلى مقاطع فيديو تصل مدتها إلى 30 ثانية. كل ما على المستخدم فعله هو كتابة الطلب مع العناصر المرجعية التي يرغب في دمجها، وسيتولى الذكاء الاصطناعي الباقي. يستطيع النموذج إنشاء مشهد كامل مع حركة كاميرا وحوار ومؤثرات صوتية متكاملة.
ومن مزايا هذا الإصدار مقارنةً بسابقه دعمه لأنواع متعددة من العناصر المرجعية. إذ يقبل Wan 3.0 ما يصل إلى عشر صور، وخمسة مقاطع فيديو، وخمسة ملفات صوتية كعناصر مرجعية في عملية إنشاء واحدة. يمكن للمستخدمين أيضًا إرفاق عرض تقديمي أو مستندات PDF، بالإضافة إلى صفحة ويب يرغبون في استخراج المعلومات أو السياق منها لإنشاء المشهد.
من الإضافات الأخرى في هذا التحديث أن برنامج Wan 3.0 يُولّد الصوت تلقائيًا. على عكس الإصدارات السابقة، تتضمن المقاطع في هذا الإصدار صوتًا، مما يسمح للشخصيات بالتحدث أو حتى الغناء بالتزامن مع المشهد. كما سيُكيّف الذكاء الاصطناعي المشهد الصوتي ليتناسب مع العناصر الأخرى ولا يبدو غريبًا، مع إمكانية إنشاء مقاطع بدون صوت إذا رغبت في ذلك.
يمكن لـ WAN 3.0 تحويل عروض PowerPoint التقديمية إلى مقاطع فيديو سينمائية
على الرغم من أن مدة المقاطع محدودة بـ 30 ثانية، إلا أن هذا لا يعني أن جميع الفيديوهات ستكون بهذا الطول. يتيح برنامج Wan 3.0 للمستخدمين تعديل المدة يدويًا، ثانية بثانية، أو عبر ميزة تقترح المدة الأنسب بناءً على محتوى الفيديو. يمكن للمستخدمين الاختيار من بين دقة عرض مختلفة، بما في ذلك 480p و720p و1080p، بنسب عرض ثابتة أو متغيرة.
فيما يتعلق بالميزات المحددة، تبرز قدرة Wan 3.0 على تحويل العروض التقديمية والمستندات إلى مقاطع فيديو. إذ يستطيع الذكاء الاصطناعي قراءة ملفات PDF أو مواقع الويب واستخدام محتواها كأساس لإنشاء المقطع، وهو أمر مفيد لتحويل عروض PowerPoint التقديمية إلى عروض مصحوبة بتعليق صوتي. مع ذلك، لا يستطيع Wan 3.0 معالجة سوى مستند واحد أو صفحة ويب واحدة في كل عملية إنشاء، وليس كليهما في آن واحد.
تشمل الميزات الجديدة الأخرى تحسينات في عرض المشاهد الرقمية، مثل واجهات البرامج والرسوم المتحركة والنصوص الظاهرة على الشاشة. عند إنشاء دروس فيديو تشرح واجهة المستخدم، لن يواجه النموذج بعد الآن نفس القدر من التناقضات البصرية التي كان يعاني منها الإصدار السابق. لم تعد الوجوه والنصوص تتشوه بين الإطارات، على الأقل ليس بنفس القدر الذي كان عليه الحال في Wan 2.7.
يتوفر Wan 3.0 الآن في مرحلة تجريبية عامة عبر Model Studio، منصة تطوير الذكاء الاصطناعي التابعة لشركة Alibaba Cloud. وأوضحت الشركة الصينية أن ذكائها الاصطناعي موجه للمحترفين الراغبين في إنشاء إعلانات قصيرة لوسائل التواصل الاجتماعي، أو مواد تدريبية للروبوتات، أو تحويل المستندات التقنية إلى مقاطع فيديو مصحوبة بتعليق صوتي.

ليست هناك تعليقات:
إرسال تعليق