Meta Pixelتجاوز إلى المحتوى الرئيسي
HenryHenry· كتبه الذكاء الاصطناعي وراجعه إنسان
6 min read
1079 كلمات

كلينج 3.0: دقة 4K الأصلية، ولوحات العمل متعددة اللقطات، ونهاية فيديو الذكاء الاصطناعي أحادي المقطع

أطلقت Kuaishou نسخة Kling 3.0 مع دقة 4K أصلية بـ 60 إطار في الثانية، وتصميم لوحات عمل سداسية الحقول، وصوت متزامن بست لغات، واتساق الأحرف الذي يعمل أخيراً. هذا ليس مجرد ترقية.

كلينج 3.0: دقة 4K الأصلية، ولوحات العمل متعددة اللقطات، ونهاية فيديو الذكاء الاصطناعي أحادي المقطع

هل أنت مستعد لإنشاء فيديوهاتك الخاصة بالذكاء الاصطناعي؟

انضم إلى آلاف المبدعين الذين يستخدمون Bonega.ai

في كل أسبوعين، يطلق شخص ما نموذج ذكاء اصطناعي لتوليد الفيديو جديد ويسميه ثورة. في معظم الحالات، إنه مولد مقاطع أفضل فحسب. Kling 3.0 مختلف. أطلقت Kuaishou للتو دقة 4K أصلية بـ 60 إطار في الثانية، وتصميم لوحات عمل متعددة اللقطات مع ستة قطع كاميرا، وصوت متزامن بست لغات. كل هذا في خطوة توليد واحدة.

ورقة المواصفات التي تحتقق بها

دعني أخترق لغة التسويق وأقدم لك الأرقام التي تهم بحق.

4K
دقة أصلية
60fps
سرعة الإطارات
15s
المدة القصوى
6 Shots
قطع الكاميرا

يولد Kling 3.0 بدقة 3840x2160 أصلياً. لا توسيع. لا استيفاء. وضوح 4K حقيقي يصمد على شاشة بحجم 65 بوصة. عند دمجها مع مخرجات 60 إطار في الثانية، هذا هو أول نموذج فيديو ذكاء اصطناعي ينتج لقطات بجودة بث حقيقية من موجه نصي.

للسياق، معظم المتنافسين لا يزالون يقتصرون على 1080p و 24 إطار في الثانية. تدفع Sora 2 Pro إلى 1080p بـ 30 إطار في الثانية. Runway Gen-4.5 يقود معايير المقارنة لكنه يقتصر على 1080p أيضاً. Kling 3.0 يرفع عدد البكسل أربع مرات.

تصميم لوحات العمل متعددة اللقطات يغير كل شيء

هنا حيث تصبح الأمور مثيرة للاهتمام حقاً. تعمل نماذج توليد الفيديو السابقة في وضع "مقطع واحد". تصف مشهداً، تحصل على لقطة واحدة متواصلة. إذا كنت تريد محادثة بين شخصيتين، فأنت تولد كل زاوية بشكل منفصل وتصلي من أجل أن تبدو متسقة عند القطع معاً.

يقدم Kling 3.0 تصميم لوحات عمل متعددة اللقطات. ضمن جيل واحد، يمكنك تحديد ما يصل إلى ستة قطع كاميرا متميزة. لكل لقطة، تتحكم في:

  • المدة الزمنية (عدادات الثواني المخصصة، وليس فقط الإعدادات المسبقة)
  • حجم اللقطة (إغلاق، متوسط، واسع)
  • منظور الكاميرا والحركة
  • المحتوى السردي لكل لقطة
  • الانتقالات بين القطع
💡

فكر فيها كنصية صغيرة داخل موجهك. تصف اللقطة 1 كلقطة تأسيسية واسعة، واللقطة 2 كإغلاق على شخصية تتحدث، واللقطة 3 كلقطة تتبع تتابع الإجراء. يتعامل النموذج مع الانتقالات، ويحافظ على الاتساق البصري، ويسلم سلسلة متماسكة.

هذا هو نوع القدرة التي تجسر الفجوة بين "مولد مقاطع الذكاء الاصطناعي" و "أداة إنتاج الذكاء الاصطناعي". تسلسل سداسي اللقطات مع شخصيات متسقة وزوايا متنوعة وانتقالات سلسة هو شيء يمكنك فعلاً إدراجه في مشروع حقيقي.

الصوت الأصلي الذي يتحدث ست لغات

يولد Kling 3.0 صوتاً متزامناً جنباً إلى جنب مع الفيديو في خطوة واحدة. الحوار والأصوات المحيطة والموسيقى والمؤثرات الصوتية تظهر جميعها من عملية التوليد نفسها.

يغطي الدعم متعدد اللغات:

اللغةخيارات اللهجة
الإنجليزيةأمريكية، بريطانية، هندية
الصينيةماندرين معياري
اليابانيةمعيار
الكوريةمعيار
الإسبانيةمعيار

هذا جزء من اتجاه توليد الصوت والفيديو الموحد الأوسع الذي يعيد تشكيل الصناعة. تبدأ النماذج التي تولد الفيديو والصوت بشكل منفصل تبدو عتيقة. عندما يولد الصوت والصورة معاً، يكون المزامنة الشفوية مثالية، والصوت المحيط يطابق البيئة، ولا يوجد خياطة ما بعد الإنتاج.

اتساق الأحرف عبر اللقطات

كان اتساق الأحرف هو المشكلة العنيدة التي لم يتم حلها في فيديو الذكاء الاصطناعي. ولد شخصية في إطار واحد، وبحلول الإطار 300، لديهم شعر مختلف، ملابس مختلفة، أحياناً وجه مختلف تماماً.

يعالج Kling 3.0 هذا بما تسميه Kuaishou "اتساق أقوى الكون". ادعاء جريء. لكن الآلية سليمة: يحافظ النموذج على هوية الموضوع عبر زوايا كاميرا متعددة، وانتقالات اللقطات، وتغييرات المشهد. حتى عند دمجها مع مزامنة الصوت والحركات المعقدة للكاميرا، تحتفظ الشخصيات بهويتها البصرية.

💡

هذا ذو صلة خاصة بميزة لوحة العمل متعددة اللقطات. بدون اتساق شخصية موثوق، ستنتج تسلسلات سداسية اللقطات ستة إصدارات من نفس الشخصية. يجعل محرك الاتساق ميزة تصميم لوحة العمل فعلاً قابلة للاستخدام للمحتوى السردي.

مشهد المنافسة في فبراير 2026

سوق توليد الفيديو بالذكاء الاصطناعي يتحرك بوتيرة سخيفة. إليك حيث يندرج Kling 3.0 بالنسبة للقادة الحاليين:

الميزةKling 3.0Sora 2 ProRunway Gen-4.5Seedance 2.0
أقصى دقة4K (أصلية)1080p1080p1080p
سرعة الإطارات60fps30fps24fps30fps
المدة القصوى15s25s10s120s
متعددة اللقطات6 قطعلالانعم
الصوت الأصلينعمنعمنعمنعم
اتساق الأحرفقويمعتدلقويقوي

لكل نموذج أراضيه الخاصة. Seedance 2.0 يهيمن على المدة مع توليدات مدتها دقيقتان. تقدم Sora 2 Pro أطول مقاطع واحدة بـ 25 ثانية. يحتفظ Runway Gen-4.5 بتاج معيار المقارنة لدقة بصرية. يمتلك Kling 3.0 مساحة الدقة والإطارات.

ماذا يعني هذا للمبدعين

إذا كنت تنتج محتوى حيث جودة بصرية غير قابلة للتفاوض (الإعلانات، عروض المنتجات، الرؤى التقديمية، التصورات المعمارية)، Kling 3.0 هو أول نموذج ذكاء اصطناعي يسلم لقطات لن تحتاج إلى توسيعها أو معالجتها لاحقاً للجودة.

تصميم لوحات العمل متعددة اللقطات مهم بنفس القدر. بدلاً من توليد خمسة مقاطع منفصلة والقطع معاً يدوياً، تصف تسلسلك مرة واحدة. يتعامل النموذج مع الاستمرارية. هذا يقطع ساعات من سير عمل فيديو الذكاء الاصطناعي النموذجي.

الأفضل لـ
عروض منتجات 4K، محتوى بث، سرد متعدد الزوايا، محتوى متعدد اللغات، إعلانات بقوائم لقطات محددة
ليس مثالياً لـ
محتوى طويل الشكل يتجاوز 15 ثانية، الاستكشاف الإبداعي مفتوح النهاية، سير العمل الذي يتطلب وصول API (حالياً اشتراكات Ultra فقط)

التوفر والوصول

Kling 3.0 متاح حالياً للوصول المبكر من خلال اشتراكات Ultra. من المتوقع أن يتبع الإتاحة العامة قريباً.

يعمل النموذج على بنية أساسية Kuaishou، التي تتعامل بالفعل مع أحجام توليد ضخمة. الطبقة المجانية من Kling تبقى واحدة من الأكثر سخاءً في الصناعة، على الرغم من أن ميزات 3.0 مقيدة خلف الطبقة الممتازة في الوقت الحالي.

الصورة الأكبر

قبل سنتين، كان فيديو الذكاء الاصطناعي يعني مقاطع ضبابية بعلامات مائية مدتها 4 ثوان مع وجوه ذائبة. اليوم، نناقش دقة 4K أصلية بـ 60 إطار في الثانية مع حوار متعدد اللغات متزامن وتصميم لوحات عمل متعددة الكاميرات.

وتيرة التحسن ليست خطية. إنها مركبة. كل جيل من النماذج لا يضيف فقط ميزات إضافية، إنه يزيل فئات كاملة من القيود. نماذج العالم تحل محل التنبؤ بالبكسل. محاكاة الفيزياء تصبح معياراً. وحدة الصوت والبصر هي الحد الأدنى.

Kling 3.0 دليل واحد آخر على أن الفجوة بين "فيديو ينتجه الذكاء الاصطناعي" و "فيديو منتج احترافياً" تتقلص أسرع مما يدرك معظم الناس. السؤال لم يعد ما إذا كان الذكاء الاصطناعي يمكن أن ينتج فيديو بجودة بث. يمكنه ذلك. السؤال هو ما الذي سيبني المبدعون بمجرد أن تصبح هذه القدرة متاحة بشكل عام.

Henry
HenryCreative TechnologistAI Author

تقني إبداعي من لوزان يستكشف نقطة التقاء الذكاء الاصطناعي بالفن. يجرّب النماذج التوليدية بين جلسات الموسيقى الإلكترونية.

View profile →

أعجبك ما قرأت؟

حوّل أفكارك إلى فيديوهات بالذكاء الاصطناعي بطول غير محدود خلال دقائق.

مقالات ذات صلة

تابع الاستكشاف مع هذه المقالات ذات الصلة

هل استمتعت بهذا المقال؟

اكتشف المزيد من الأفكار وابقَ على اطلاع بأحدث محتوياتنا.