Meta Pixelتجاوز إلى المحتوى الرئيسي
AlexisAlexis· كتبه الذكاء الاصطناعي وراجعه إنسان
6 min read
1011 كلمات

Alibaba Wan 2.7: كيف يغيّر وضع التفكير مستقبل توليد الفيديو بالذكاء الاصطناعي

أطلقت Alibaba نموذج Wan 2.7 مع وضع تفكير مبتكر يخطط لتكوين المشاهد قبل توليد الفيديو. نستعرض آلية عمله وما يعنيه للمبدعين.

Alibaba Wan 2.7: كيف يغيّر وضع التفكير مستقبل توليد الفيديو بالذكاء الاصطناعي

هل أنت مستعد لإنشاء فيديوهاتك الخاصة بالذكاء الاصطناعي؟

انضم إلى آلاف المبدعين الذين يستخدمون Bonega.ai

أطلق مختبر Tongyi التابع لشركة Alibaba نموذج Wan 2.7 في السادس من أبريل 2026، مقدّماً "وضع التفكير" الذي يغيّر جذرياً طريقة معالجة نماذج الفيديو الذكية للنصوص الوصفية. فبدلاً من توليد الإطارات مباشرة من النص، يبني النموذج أولاً خطة داخلية للمشهد ثم ينفّذها. والنتائج واضحة: تشوّهات أقل، تماسك أفضل، وتكوينات أكثر دقة وقصدية.

ما هو وضع التفكير؟

تعمل معظم نماذج توليد الفيديو بتمريرة واحدة. تكتب نصاً وصفياً، يبدأ النموذج بتحويل الضوضاء إلى بكسلات، وتحصل على ما ينتج. يعمل هذا بشكل مقبول للمشاهد البسيطة، لكنه يفشل عندما تتضمن النصوص عناصر متعددة أو علاقات مكانية محددة أو حركات معقدة.

يضيف Wan 2.7 خطوة وسيطة. قبل توليد أي بكسل، يقوم النموذج بما يلي:

  1. تحليل النص الوصفي إلى مكونات دلالية (عناصر، حركات، بيئة، إضاءة)
  2. تخطيط التكوين بتحديد مواضع العناصر وكيفية تفاعلها
  3. توليد المخرج باستخدام هذه الخطة كدليل هيكلي
💡
تخيّل الأمر كالفرق بين الرسم الارتجالي ورسم دراسة تكوينية أولاً. لا يظهر المخطط في العمل النهائي، لكنه يوجّه كل ضربة فرشاة.

يشبه هذا طريقة تحسين "سلسلة التفكير" للنماذج اللغوية الكبيرة. فبإجبار النموذج على التفكير قبل التنفيذ، تتحسّن جودة المخرجات بشكل ملحوظ، خاصة مع النصوص الوصفية المعقدة.

مجموعة Wan 2.7 الكاملة

لا يقتصر Wan 2.7 على نموذج واحد. بل يأتي كمجموعة من أربعة نماذج تغطي سير عمل مختلفة للتوليد:

4
مجموعة النماذج
$0.10/s
تسعير API
6 أبريل
تاريخ الإطلاق
النموذجالمدخلالمخرجالأنسب لـ
نص إلى فيديونص وصفيمقطع فيديوالإنشاء من الصفر
صورة إلى فيديوصورة + نص وصفيمقطع فيديوتحريك الصور الثابتة والرسوم المفاهيمية
مرجع إلى فيديوفيديو مرجعي + نص وصفيفيديو جديدنقل الأسلوب وإعادة الإنشاء
تحرير الفيديوفيديو + تعليمات تحريرفيديو معدّلمرحلة ما بعد الإنتاج والتصحيحات

نموذج النص إلى الفيديو متاح بالفعل على Together AI منذ الثالث من أبريل. أما النماذج الثلاثة المتبقية فسيتم إطلاقها تدريجياً خلال الأسابيع القادمة.

نظرة تقنية: تفاصيل البنية

رغم أن Alibaba لم تنشر ورقة بحثية كاملة بعد، ظهرت عدة تفاصيل تقنية من وثائق API والاختبارات المبكرة.

ما نعرفهما يميّزه
مبني على سلالة بنية Wan (Wanxiang)أول نموذج إنتاجي بتخطيط تكويني صريح
يضيف وضع التفكير تمريرة تخطيط قبل الانتشارالمشاهد متعددة العناصر تتعامل مع 5+ عناصر بسلاسة
تماسك فائق الواقعية للشخصيات عبر الإطاراتالنصوص المعروضة في الفيديو مقروءة وليست مشوّهة
تحكم دقيق بالألوان عبر تهيئة النص الوصفيدقة الألوان تبقى متسقة مع تغيّرات الإضاءة
عرض نصوص طويلة متفوّق (نصوص داخل الفيديو)حركات الكاميرا المعقدة تحافظ على التماسك المكاني

تبرز قدرة عرض النصوص الطويلة بشكل خاص. فالنماذج السابقة كانت تعاني من توليد نصوص مقروءة داخل إطارات الفيديو. يتعامل Wan 2.7 مع اللافتات والتسميات وحتى الفقرات القصيرة بدقة مفاجئة. للمبدعين الذين يحتاجون إلى نصوص مدمجة في اللقطات المولّدة، هذه خطوة مهمة إلى الأمام.

المقارنة مع المنافسين

شهد مشهد الفيديو بالذكاء الاصطناعي تحوّلاً ملحوظاً هذا الأسبوع، مع وصول Wan 2.7 بالتزامن مع تأكيد OpenAI إيقاف Sora وخفض Google لأسعار Veo 3.1.

النموذجالتسعيرالصوتأقصى مدةتماسك الشخصياتالتفكير/التخطيط
Wan 2.7$0.10/ثلا~10 ثوانٍقوينعم
Veo 3.1 Lite$0.05/ثنعم~8 ثوانٍجيدلا
Veo 3.1 Fast$0.12/ثنعم~8 ثوانٍقويلا
Kling 3.0~$0.08-0.17/ثنعم~10 ثوانٍقويلا
Seedance 2.0مجمّعنعم15 ثانيةجيدلا
Runway Gen-4.5~$0.15/ثلا~10 ثوانٍقويلا
⚠️
لا يتضمن Wan 2.7 توليد صوت مدمج. للمشاريع التي تتطلب صوتاً متزامناً، ستحتاج إلى خط إنتاج صوتي منفصل أو نموذج مثل Kling 3.0 أو Veo 3.1 الذي يولّد الصوت بشكل أصلي.

يضع التسعير بقيمة $0.10 للثانية نموذج Wan 2.7 في الفئة التنافسية المتوسطة. فهو ضعف تكلفة خيار Google الاقتصادي Lite، ومنافس لـ Kling 3.0 (الذي يتفاوت حسب المنصة)، وأقل سعراً من Runway بشكل ملحوظ.

متى تستخدم Wan 2.7

بناءً على الاختبارات المبكرة ونقاط قوة النموذج، إليك السيناريوهات التي يكون فيها Wan 2.7 الخيار الأمثل:

🎬

مشاهد معقدة متعددة العناصر

يتألق وضع التفكير عندما يتضمن نصك الوصفي شخصيات أو عناصر متعددة تتفاعل معاً. تمنع خطوة التخطيط الارتباك المكاني الذي يعاني منه النماذج الأخرى.
📝

محتوى غني بالنصوص

إذا كان الفيديو يحتاج نصوصاً مقروءة أو لافتات أو عناصر واجهة مستخدم، فإن عرض النصوص في Wan 2.7 هو الأفضل حالياً في فئته.
🎨

تحكم دقيق بالألوان والأسلوب

يتيح نظام تهيئة الألوان تحديد لوحات ألوان دقيقة والحفاظ عليها عبر الإطارات، وهو مفيد للمحتوى المتسق مع الهوية البصرية.
🔄

نقل الأسلوب عبر المرجع

سيتيح نموذج المرجع إلى الفيديو (قريباً) تقديم مقطع موجود كدليل أسلوبي لتوليد محتوى جديد يطابق لغته البصرية.

للمشاهد الأبسط ذات العنصر الواحد التي تحتاج فيها إلى صوت أيضاً، قد تظل نماذج مثل Kling 3.0 أو Veo 3.1 الخيار الأفضل. تضيف عملية التخطيط في وضع التفكير قيمة تحديداً عندما تكون النصوص الوصفية معقدة.

ماذا يعني هذا للصناعة

يشير وضع التفكير في Wan 2.7 إلى تحوّل أوسع في طريقة عمل النماذج التوليدية. فبدلاً من فرض المخرجات من الضوضاء بالقوة، ستدمج النماذج المستقبلية على الأرجح مراحل تخطيط صريحة لجوانب مختلفة من التوليد.

نشهد هذا النمط بالفعل في مجالات أخرى. نماذج توليد الشفرات البرمجية تخطط قبل الكتابة. نماذج الصور تستخدم تهيئة التخطيط. والآن نماذج الفيديو تتعلم التفكير قبل الإبداع.

💡
الوتيرة السريعة لإطلاق النماذج في 2026 تجعل الالتزام بمزوّد واحد محفوفاً بالمخاطر. الأساليب القائمة على خطوط الإنتاج التي تتيح تبديل محركات التوليد مع ظهور نماذج أفضل تحمي سير عملك من الارتباط بمزوّد واحد.

الضغط التنافسي حقيقي. مع خروج Sora، وخفض Google للأسعار، ونماذج صينية مثل Wan 2.7 وKling 3.0 تدفع حدود الجودة، لم يكن أمام المبدعين خيارات أكثر من الآن، ولا أسباب أكثر للبقاء مرنين.

لإلقاء نظرة أعمق على مقارنة أداء هذه النماذج في اختبارات محددة، اطلع على تحليلنا لأداء Runway Gen-4.5. وإذا كنت مهتماً بكيفية تأثير إطلاق Seedance 2.0 على منظومة CapCut، فقد غطّينا ذلك بالتفصيل الشهر الماضي.

Alexis
AlexisAI EngineerAI Author

مهندس ذكاء اصطناعي من لوزان يجمع بين عمق البحث والابتكار العملي. يقسم وقته بين هياكل النماذج والقمم الجبلية.

View profile →

أعجبك ما قرأت؟

حوّل أفكارك إلى فيديوهات بالذكاء الاصطناعي بطول غير محدود خلال دقائق.

مقالات ذات صلة

تابع الاستكشاف مع هذه المقالات ذات الصلة

هل استمتعت بهذا المقال؟

اكتشف المزيد من الأفكار وابقَ على اطلاع بأحدث محتوياتنا.