Meta Pixelتجاوز إلى المحتوى الرئيسي
HenryHenry· كاتب ذكاء اصطناعي، فحوصات آلية، المسؤولية للمحرر
5 min read
917 كلمات

PikaStream 1.0: مختبرات Pika تمنح كل وكيل ذكاء اصطناعي وجها وصوتا ومقعدا في اجتماعك

أطلقت Pika Labs نموذج PikaStream 1.0 للفيديو في الوقت الفعلي، الذي يتيح لوكلاء الذكاء الاصطناعي الانضمام إلى مكالمات Google Meet بصور رمزية مُولّدة وأصوات مستنسخة وتنفيذ كامل للمهام. إليك ما يعنيه ذلك لمستقبل التفاعل مع الذكاء الاصطناعي.

PikaStream 1.0: مختبرات Pika تمنح كل وكيل ذكاء اصطناعي وجها وصوتا ومقعدا في اجتماعك

هل أنت مستعد لإنشاء فيديوهاتك الخاصة بالذكاء الاصطناعي؟

انضم إلى آلاف المبدعين الذين يستخدمون Bonega.ai يبدأ الإنشاء بعد الدفع.

لسنوات، كان توليد الفيديو بالذكاء الاصطناعي يعني شيئا واحدا: اكتب أمرا نصيا، انتظر، ثم حمّل مقطعا. PikaStream 1.0 يكسر هذا النمط بالكامل. الآن يمكن لوكيل الذكاء الاصطناعي أن ينظر إليك مباشرة أثناء مكالمة Google Meet، ويستجيب في الوقت الفعلي، وينفذ المهام أثناء حديثك.

التحول الذي لم يتوقعه أحد

بنت Pika Labs سمعتها على الأدوات الإبداعية. Pika 2.5 جعل تحويل النص إلى فيديو متاحا للجميع. أما Pika Effects فحوّل الصور الثابتة إلى حركة. بدا المسار واضحا: مقاطع أجمل، مدد أطول، فيزياء أفضل.

ثم أطلقوا PikaStream، وانحرف المسار بشكل غير متوقع.

بدلا من التنافس على جودة المقاطع (سباق تخوضه بالفعل Runway وKling وGoogle)، بنت Pika محرك فيديو يعمل في الوقت الفعلي مصمم للتفاعل المباشر. المستخدم المستهدف ليس صانع أفلام، بل وكيل ذكاء اصطناعي.

💡
PikaStream 1.0 ليس مولّد فيديو بالمفهوم التقليدي. إنه طبقة بنية تحتية تمنح وكلاء الذكاء الاصطناعي حضورا بصريا وصوتيا في مكالمات الفيديو المباشرة.

ما الذي يفعله PikaStream فعليا

المنتج الأساسي هو وحدة مهارات مستقلة تتكامل مع وكلاء البرمجة بالذكاء الاصطناعي مثل Claude Code ومساعدي OpenAI أو أي نظام يدعم واجهة Pika Developer API. بمجرد التثبيت، يمكن للوكيل:

  • الانضمام إلى مكالمة Google Meet بصورة رمزية مُولّدة بالكامل
  • التحدث بصوت مستنسخ (سجّل عينة قصيرة، والوكيل يتحدث بصوتك)
  • الاحتفاظ بذاكرة المحادثات السابقة والسياق
  • تنفيذ المهام أثناء المكالمة (كتابة كود، البحث عن بيانات، تشغيل إجراءات)

الصورة الرمزية ليست صورة ثابتة مع طبقة مزامنة شفاه. يولّد PikaStream فيديو مخصصا بمعدل يصل إلى 30 إطارا في الثانية وبدقة 480p، مدعوما بخط إنتاج انتشار يعمل في الوقت الفعلي على وحدة GPU واحدة من نوع H100.

30 FPS
معدل الإطارات في الوقت الفعلي
~1.5s
زمن الاستجابة من الكلام إلى الفيديو
$0.20
التكلفة لكل دقيقة

تحت الغطاء: FlashVAE والبث المباشر بـ DiT

ابتكاران معماريان يجعلان الأداء في الوقت الفعلي ممكنا.

FlashVAE هو مشفّر تبايني ذاتي (VAE) قائم بالكامل على بنية Transformer، تم تدريبه من الصفر. يوفر فضاءه الكامن الخاص ويعيد بناء الفيديو من خلال فك تشفير متدفق بمعدل مئات الإطارات في الثانية مع استهلاك ضئيل لذاكرة GPU. هذا هو المكوّن الذي يجعل الإخراج في الوقت الفعلي ممكنا دون الحاجة إلى مزرعة وحدات GPU.

محوّل الانتشار بحجم 9 مليار معامل (DiT) يستخدم تقنية تدريب ذكية: يتم تقطير نموذج معلّم ثنائي الاتجاه إلى طالب انحداري ذاتي سببي من خلال إجبار ذاتي محسّن. يتيح ذلك البث على شكل أجزاء بمعدلات إطارات في الوقت الفعلي، تماما كما تبث نماذج اللغة النص رمزا تلو الآخر.

💡
الجمع بين FlashVAE لإعادة البناء ومحوّل الانتشار المتدفق للتوليد يعني أن PikaStream يمكنه الحفاظ على تناسق الهوية البصرية طوال الاجتماع بأكمله، وليس فقط في مقطع واحد.

لماذا هذا أهم من مجرد نموذج فيديو جميل آخر

ساحة الفيديو بالذكاء الاصطناعي في أبريل 2026 مزدحمة. Runway Gen-4.5 يتعامل مع الجودة السينمائية. Kling 3.0 ينشئ لوحات قصصية متعددة اللقطات. Seedance 2.0 يولّد الصوت والفيديو معا. Google Veo 3.1 موجود في كل مكان.

PikaStream لا ينافس أيا منها.

إنه ينافس صور Zoom الرمزية، ومقدّمي Synthesia، والمفهوم الكامل لـ"يجب أن تكون حاضرا أمام الكاميرا". الفرق أن صور PikaStream الرمزية ليست مسجلة مسبقا أو مكتوبة. إنها تتفاعل وتستجيب وتتصرف في الوقت الفعلي.

فيديو الذكاء الاصطناعي التقليدي
توليد مقطع، تحميله، مشاركته لاحقا. لا تفاعلية. دقائق من وقت المعالجة لكل ثانية من الإخراج.
نهج PikaStream
توليد مباشر أثناء المكالمة. تفاعلي، متجاوب، متسق الهوية. الوكيل مشارك في الاجتماع، وليس تسجيلا.

مفهوم "الذات الرقمية"

تروّج Pika أيضا لجانب استهلاكي تسميه Pika AI Self. الفكرة: أنشئ نسخة رقمية من نفسك يمكنها حضور الاجتماعات نيابة عنك. صورتك الرمزية تشبهك، وتتحدث بصوتك (عبر استنساخ الصوت)، ولديها وصول إلى تقويمك وملاحظاتك وسجل محادثاتك.

هذا لم يعد خيالا علميا. النسخة التجريبية تعمل على Google Meet اليوم، مع دعم Zoom وFaceTime قريبا.

التأثيرات على العمل عن بُعد فورية:

  • تخطَّ الاجتماع، وأرسل ذاتك الرقمية مع سياق حول ما تحتاجه
  • دع الوكيل يدوّن الملاحظات، ويتخذ القرارات ضمن حدود محددة، ويقدم لك تقريرا
  • حضور اجتماعات متعددة في الوقت نفسه، كل منها بحضورك المتسق
⚠️
يثير استنساخ الصوت وتوليد الصور الرمزية تساؤلات حول الموافقة وانتحال الهوية. تشترط Pika الحصول على تفويض صريح من المستخدم لاستنساخ الصوت، لكن الإطار التنظيمي الأوسع لحضور الذكاء الاصطناعي في الاجتماعات لا يزال غير محدد.

التسعير والوصول

سعر PikaStream هو $0.20 لكل دقيقة من المشاركة في الاجتماع. لاجتماع مدته 30 دقيقة، يعني ذلك $6. مقارنة بإرسال ممثل بشري أو تفويت الاجتماع بالكامل، فإن الحسابات الاقتصادية منطقية لحالات استخدام معينة: تحديثات الحالة، جمع المعلومات، المتابعات الروتينية.

المهارة متاحة عبر Pika Developer API ويمكن تثبيتها كوحدة في أُطر عمل الوكلاء المتوافقة. Google Meet هو المنصة الوحيدة المدعومة عند الإطلاق.

ما الذي يشير إليه هذا بالنسبة للصناعة

يمثل PikaStream انقساما في فئات الفيديو بالذكاء الاصطناعي. من جهة: التوليد دون اتصال (Runway، Kling، Veo) المركّز على إنشاء المحتوى. ومن الجهة الأخرى: التوليد في الوقت الفعلي للتفاعل المباشر، والحضور عن بُعد، وتجسيد الوكلاء.

2024

عصر تحويل النص إلى فيديو

مقاطع من 4-10 ثوان، عروض مبهرة، استخدام عملي محدود

2025

مقاطع بجودة إنتاجية

فيديوهات متماسكة مدتها 60 ثانية، صوت أصلي، تناسق الشخصيات

2026

الوقت الفعلي والتفاعلية

توليد فيديو مباشر للوكلاء والاجتماعات والتطبيقات التفاعلية

النماذج التي تولّد مقاطع جميلة مدتها دقيقتان والنماذج التي تشغّل صورا رمزية مباشرة بمعدل 30 إطارا في الثانية تحل مشكلات مختلفة. PikaStream هو أول دخول جاد في الفئة الثانية، ولن يكون الأخير.

بالنسبة للمبدعين والمطورين، السؤال لم يعد فقط "كيف يمكن أن يبدو الفيديو بالذكاء الاصطناعي؟" بل أصبح "أين يمكن أن يظهر الفيديو بالذكاء الاصطناعي، وماذا يمكنه أن يفعل عندما يصل إلى هناك؟"

💡
هل تريد استكشاف توليد الفيديو بالذكاء الاصطناعي لمشاريعك؟ جرّب خط إنتاج Bonega لإنشاء فيديوهات عالية الجودة من النصوص أو الصور، مع ترقيات تلقائية إلى أحدث النماذج دون تكلفة إضافية.
Henry
HenryCreative TechnologistAI Author

شخصية تقني إبداعي. يغطي الفيديو التوليدي كوسيط إبداعي: الأوامر، والأساليب، ومسارات عمل الإنتاج. كُتبت المسودة باستخدام Claude، ونُشرت بعد فحوصات آلية.

View profile →

أعجبك ما قرأت؟

حوّل أفكارك إلى فيديوهات بالذكاء الاصطناعي بطول غير محدود خلال دقائق. يبدأ الإنشاء بعد الدفع.

مقالات ذات صلة

تابع الاستكشاف مع هذه المقالات ذات الصلة

هل استمتعت بهذا المقال؟

اكتشف المزيد من الأفكار وابقَ على اطلاع بأحدث محتوياتنا.