كلينج 3.0: دقة 4K الأصلية، ولوحات العمل متعددة اللقطات، ونهاية فيديو الذكاء الاصطناعي أحادي المقطع
أطلقت Kuaishou نسخة Kling 3.0 مع دقة 4K أصلية بـ 60 إطار في الثانية، وتصميم لوحات عمل سداسية الحقول، وصوت متزامن بست لغات، واتساق الأحرف الذي يعمل أخيراً. هذا ليس مجرد ترقية.

هل أنت مستعد لإنشاء فيديوهاتك الخاصة بالذكاء الاصطناعي؟
انضم إلى آلاف المبدعين الذين يستخدمون Bonega.ai
ورقة المواصفات التي تحتقق بها
دعني أخترق لغة التسويق وأقدم لك الأرقام التي تهم بحق.
يولد Kling 3.0 بدقة 3840x2160 أصلياً. لا توسيع. لا استيفاء. وضوح 4K حقيقي يصمد على شاشة بحجم 65 بوصة. عند دمجها مع مخرجات 60 إطار في الثانية، هذا هو أول نموذج فيديو ذكاء اصطناعي ينتج لقطات بجودة بث حقيقية من موجه نصي.
للسياق، معظم المتنافسين لا يزالون يقتصرون على 1080p و 24 إطار في الثانية. تدفع Sora 2 Pro إلى 1080p بـ 30 إطار في الثانية. Runway Gen-4.5 يقود معايير المقارنة لكنه يقتصر على 1080p أيضاً. Kling 3.0 يرفع عدد البكسل أربع مرات.
تصميم لوحات العمل متعددة اللقطات يغير كل شيء
هنا حيث تصبح الأمور مثيرة للاهتمام حقاً. تعمل نماذج توليد الفيديو السابقة في وضع "مقطع واحد". تصف مشهداً، تحصل على لقطة واحدة متواصلة. إذا كنت تريد محادثة بين شخصيتين، فأنت تولد كل زاوية بشكل منفصل وتصلي من أجل أن تبدو متسقة عند القطع معاً.
يقدم Kling 3.0 تصميم لوحات عمل متعددة اللقطات. ضمن جيل واحد، يمكنك تحديد ما يصل إلى ستة قطع كاميرا متميزة. لكل لقطة، تتحكم في:
- المدة الزمنية (عدادات الثواني المخصصة، وليس فقط الإعدادات المسبقة)
- حجم اللقطة (إغلاق، متوسط، واسع)
- منظور الكاميرا والحركة
- المحتوى السردي لكل لقطة
- الانتقالات بين القطع
فكر فيها كنصية صغيرة داخل موجهك. تصف اللقطة 1 كلقطة تأسيسية واسعة، واللقطة 2 كإغلاق على شخصية تتحدث، واللقطة 3 كلقطة تتبع تتابع الإجراء. يتعامل النموذج مع الانتقالات، ويحافظ على الاتساق البصري، ويسلم سلسلة متماسكة.
هذا هو نوع القدرة التي تجسر الفجوة بين "مولد مقاطع الذكاء الاصطناعي" و "أداة إنتاج الذكاء الاصطناعي". تسلسل سداسي اللقطات مع شخصيات متسقة وزوايا متنوعة وانتقالات سلسة هو شيء يمكنك فعلاً إدراجه في مشروع حقيقي.
الصوت الأصلي الذي يتحدث ست لغات
يولد Kling 3.0 صوتاً متزامناً جنباً إلى جنب مع الفيديو في خطوة واحدة. الحوار والأصوات المحيطة والموسيقى والمؤثرات الصوتية تظهر جميعها من عملية التوليد نفسها.
يغطي الدعم متعدد اللغات:
| اللغة | خيارات اللهجة |
|---|---|
| الإنجليزية | أمريكية، بريطانية، هندية |
| الصينية | ماندرين معياري |
| اليابانية | معيار |
| الكورية | معيار |
| الإسبانية | معيار |
هذا جزء من اتجاه توليد الصوت والفيديو الموحد الأوسع الذي يعيد تشكيل الصناعة. تبدأ النماذج التي تولد الفيديو والصوت بشكل منفصل تبدو عتيقة. عندما يولد الصوت والصورة معاً، يكون المزامنة الشفوية مثالية، والصوت المحيط يطابق البيئة، ولا يوجد خياطة ما بعد الإنتاج.
اتساق الأحرف عبر اللقطات
كان اتساق الأحرف هو المشكلة العنيدة التي لم يتم حلها في فيديو الذكاء الاصطناعي. ولد شخصية في إطار واحد، وبحلول الإطار 300، لديهم شعر مختلف، ملابس مختلفة، أحياناً وجه مختلف تماماً.
يعالج Kling 3.0 هذا بما تسميه Kuaishou "اتساق أقوى الكون". ادعاء جريء. لكن الآلية سليمة: يحافظ النموذج على هوية الموضوع عبر زوايا كاميرا متعددة، وانتقالات اللقطات، وتغييرات المشهد. حتى عند دمجها مع مزامنة الصوت والحركات المعقدة للكاميرا، تحتفظ الشخصيات بهويتها البصرية.
هذا ذو صلة خاصة بميزة لوحة العمل متعددة اللقطات. بدون اتساق شخصية موثوق، ستنتج تسلسلات سداسية اللقطات ستة إصدارات من نفس الشخصية. يجعل محرك الاتساق ميزة تصميم لوحة العمل فعلاً قابلة للاستخدام للمحتوى السردي.
مشهد المنافسة في فبراير 2026
سوق توليد الفيديو بالذكاء الاصطناعي يتحرك بوتيرة سخيفة. إليك حيث يندرج Kling 3.0 بالنسبة للقادة الحاليين:
| الميزة | Kling 3.0 | Sora 2 Pro | Runway Gen-4.5 | Seedance 2.0 |
|---|---|---|---|---|
| أقصى دقة | 4K (أصلية) | 1080p | 1080p | 1080p |
| سرعة الإطارات | 60fps | 30fps | 24fps | 30fps |
| المدة القصوى | 15s | 25s | 10s | 120s |
| متعددة اللقطات | 6 قطع | لا | لا | نعم |
| الصوت الأصلي | نعم | نعم | نعم | نعم |
| اتساق الأحرف | قوي | معتدل | قوي | قوي |
لكل نموذج أراضيه الخاصة. Seedance 2.0 يهيمن على المدة مع توليدات مدتها دقيقتان. تقدم Sora 2 Pro أطول مقاطع واحدة بـ 25 ثانية. يحتفظ Runway Gen-4.5 بتاج معيار المقارنة لدقة بصرية. يمتلك Kling 3.0 مساحة الدقة والإطارات.
ماذا يعني هذا للمبدعين
إذا كنت تنتج محتوى حيث جودة بصرية غير قابلة للتفاوض (الإعلانات، عروض المنتجات، الرؤى التقديمية، التصورات المعمارية)، Kling 3.0 هو أول نموذج ذكاء اصطناعي يسلم لقطات لن تحتاج إلى توسيعها أو معالجتها لاحقاً للجودة.
تصميم لوحات العمل متعددة اللقطات مهم بنفس القدر. بدلاً من توليد خمسة مقاطع منفصلة والقطع معاً يدوياً، تصف تسلسلك مرة واحدة. يتعامل النموذج مع الاستمرارية. هذا يقطع ساعات من سير عمل فيديو الذكاء الاصطناعي النموذجي.
التوفر والوصول
Kling 3.0 متاح حالياً للوصول المبكر من خلال اشتراكات Ultra. من المتوقع أن يتبع الإتاحة العامة قريباً.
يعمل النموذج على بنية أساسية Kuaishou، التي تتعامل بالفعل مع أحجام توليد ضخمة. الطبقة المجانية من Kling تبقى واحدة من الأكثر سخاءً في الصناعة، على الرغم من أن ميزات 3.0 مقيدة خلف الطبقة الممتازة في الوقت الحالي.
الصورة الأكبر
قبل سنتين، كان فيديو الذكاء الاصطناعي يعني مقاطع ضبابية بعلامات مائية مدتها 4 ثوان مع وجوه ذائبة. اليوم، نناقش دقة 4K أصلية بـ 60 إطار في الثانية مع حوار متعدد اللغات متزامن وتصميم لوحات عمل متعددة الكاميرات.
وتيرة التحسن ليست خطية. إنها مركبة. كل جيل من النماذج لا يضيف فقط ميزات إضافية، إنه يزيل فئات كاملة من القيود. نماذج العالم تحل محل التنبؤ بالبكسل. محاكاة الفيزياء تصبح معياراً. وحدة الصوت والبصر هي الحد الأدنى.
Kling 3.0 دليل واحد آخر على أن الفجوة بين "فيديو ينتجه الذكاء الاصطناعي" و "فيديو منتج احترافياً" تتقلص أسرع مما يدرك معظم الناس. السؤال لم يعد ما إذا كان الذكاء الاصطناعي يمكن أن ينتج فيديو بجودة بث. يمكنه ذلك. السؤال هو ما الذي سيبني المبدعون بمجرد أن تصبح هذه القدرة متاحة بشكل عام.

تقني إبداعي من لوزان يستكشف نقطة التقاء الذكاء الاصطناعي بالفن. يجرّب النماذج التوليدية بين جلسات الموسيقى الإلكترونية.
View profile →مقالات ذات صلة
تابع الاستكشاف مع هذه المقالات ذات الصلة

Kling 2.6: استنساخ الصوت والتحكم بالحركة يعيدان تعريف إنتاج الفيديو بالذكاء الاصطناعي
يقدم التحديث الأخير من Kuaishou توليداً متزامناً للصوت والصورة، وتدريباً مخصصاً للصوت، والتقاط حركة دقيق قد يغير طريقة تعامل صناع المحتوى مع إنتاج الفيديو بالذكاء الاصطناعي.

SkyReels V4: أول نموذج ذكاء اصطناعي يرى ويسمع في آنٍ واحد
يقدم SkyReels V4 من Skywork AI بنية انتشار ثنائية التيار تولّد الفيديو والصوت المتزامن معاً في تمريرة واحدة. إليك ما يعنيه ذلك للمبدعين.

Bonega مقابل Kling AI في 2026: أي منصة فيديو بالذكاء الاصطناعي تناسبك؟
تنتج كل من Bonega.ai وKling AI فيديوهات احترافية بالذكاء الاصطناعي مع صوت أصلي. نقارن المدة والأسعار والميزات ونحدد المنصة الأنسب لكل منشئ محتوى.