PikaStream 1.0: مختبرات Pika تمنح كل وكيل ذكاء اصطناعي وجها وصوتا ومقعدا في اجتماعك
أطلقت Pika Labs نموذج PikaStream 1.0 للفيديو في الوقت الفعلي، الذي يتيح لوكلاء الذكاء الاصطناعي الانضمام إلى مكالمات Google Meet بصور رمزية مُولّدة وأصوات مستنسخة وتنفيذ كامل للمهام. إليك ما يعنيه ذلك لمستقبل التفاعل مع الذكاء الاصطناعي.

هل أنت مستعد لإنشاء فيديوهاتك الخاصة بالذكاء الاصطناعي؟
انضم إلى آلاف المبدعين الذين يستخدمون Bonega.ai
التحول الذي لم يتوقعه أحد
بنت Pika Labs سمعتها على الأدوات الإبداعية. Pika 2.5 جعل تحويل النص إلى فيديو متاحا للجميع. أما Pika Effects فحوّل الصور الثابتة إلى حركة. بدا المسار واضحا: مقاطع أجمل، مدد أطول، فيزياء أفضل.
ثم أطلقوا PikaStream، وانحرف المسار بشكل غير متوقع.
بدلا من التنافس على جودة المقاطع (سباق تخوضه بالفعل Runway وKling وGoogle)، بنت Pika محرك فيديو يعمل في الوقت الفعلي مصمم للتفاعل المباشر. المستخدم المستهدف ليس صانع أفلام، بل وكيل ذكاء اصطناعي.
ما الذي يفعله PikaStream فعليا
المنتج الأساسي هو وحدة مهارات مستقلة تتكامل مع وكلاء البرمجة بالذكاء الاصطناعي مثل Claude Code ومساعدي OpenAI أو أي نظام يدعم واجهة Pika Developer API. بمجرد التثبيت، يمكن للوكيل:
- الانضمام إلى مكالمة Google Meet بصورة رمزية مُولّدة بالكامل
- التحدث بصوت مستنسخ (سجّل عينة قصيرة، والوكيل يتحدث بصوتك)
- الاحتفاظ بذاكرة المحادثات السابقة والسياق
- تنفيذ المهام أثناء المكالمة (كتابة كود، البحث عن بيانات، تشغيل إجراءات)
الصورة الرمزية ليست صورة ثابتة مع طبقة مزامنة شفاه. يولّد PikaStream فيديو مخصصا بمعدل يصل إلى 30 إطارا في الثانية وبدقة 480p، مدعوما بخط إنتاج انتشار يعمل في الوقت الفعلي على وحدة GPU واحدة من نوع H100.
تحت الغطاء: FlashVAE والبث المباشر بـ DiT
ابتكاران معماريان يجعلان الأداء في الوقت الفعلي ممكنا.
FlashVAE هو مشفّر تبايني ذاتي (VAE) قائم بالكامل على بنية Transformer، تم تدريبه من الصفر. يوفر فضاءه الكامن الخاص ويعيد بناء الفيديو من خلال فك تشفير متدفق بمعدل مئات الإطارات في الثانية مع استهلاك ضئيل لذاكرة GPU. هذا هو المكوّن الذي يجعل الإخراج في الوقت الفعلي ممكنا دون الحاجة إلى مزرعة وحدات GPU.
محوّل الانتشار بحجم 9 مليار معامل (DiT) يستخدم تقنية تدريب ذكية: يتم تقطير نموذج معلّم ثنائي الاتجاه إلى طالب انحداري ذاتي سببي من خلال إجبار ذاتي محسّن. يتيح ذلك البث على شكل أجزاء بمعدلات إطارات في الوقت الفعلي، تماما كما تبث نماذج اللغة النص رمزا تلو الآخر.
لماذا هذا أهم من مجرد نموذج فيديو جميل آخر
ساحة الفيديو بالذكاء الاصطناعي في أبريل 2026 مزدحمة. Runway Gen-4.5 يتعامل مع الجودة السينمائية. Kling 3.0 ينشئ لوحات قصصية متعددة اللقطات. Seedance 2.0 يولّد الصوت والفيديو معا. Google Veo 3.1 موجود في كل مكان.
PikaStream لا ينافس أيا منها.
إنه ينافس صور Zoom الرمزية، ومقدّمي Synthesia، والمفهوم الكامل لـ"يجب أن تكون حاضرا أمام الكاميرا". الفرق أن صور PikaStream الرمزية ليست مسجلة مسبقا أو مكتوبة. إنها تتفاعل وتستجيب وتتصرف في الوقت الفعلي.
مفهوم "الذات الرقمية"
تروّج Pika أيضا لجانب استهلاكي تسميه Pika AI Self. الفكرة: أنشئ نسخة رقمية من نفسك يمكنها حضور الاجتماعات نيابة عنك. صورتك الرمزية تشبهك، وتتحدث بصوتك (عبر استنساخ الصوت)، ولديها وصول إلى تقويمك وملاحظاتك وسجل محادثاتك.
هذا لم يعد خيالا علميا. النسخة التجريبية تعمل على Google Meet اليوم، مع دعم Zoom وFaceTime قريبا.
التأثيرات على العمل عن بُعد فورية:
- تخطَّ الاجتماع، وأرسل ذاتك الرقمية مع سياق حول ما تحتاجه
- دع الوكيل يدوّن الملاحظات، ويتخذ القرارات ضمن حدود محددة، ويقدم لك تقريرا
- حضور اجتماعات متعددة في الوقت نفسه، كل منها بحضورك المتسق
التسعير والوصول
سعر PikaStream هو $0.20 لكل دقيقة من المشاركة في الاجتماع. لاجتماع مدته 30 دقيقة، يعني ذلك $6. مقارنة بإرسال ممثل بشري أو تفويت الاجتماع بالكامل، فإن الحسابات الاقتصادية منطقية لحالات استخدام معينة: تحديثات الحالة، جمع المعلومات، المتابعات الروتينية.
المهارة متاحة عبر Pika Developer API ويمكن تثبيتها كوحدة في أُطر عمل الوكلاء المتوافقة. Google Meet هو المنصة الوحيدة المدعومة عند الإطلاق.
ما الذي يشير إليه هذا بالنسبة للصناعة
يمثل PikaStream انقساما في فئات الفيديو بالذكاء الاصطناعي. من جهة: التوليد دون اتصال (Runway، Kling، Veo) المركّز على إنشاء المحتوى. ومن الجهة الأخرى: التوليد في الوقت الفعلي للتفاعل المباشر، والحضور عن بُعد، وتجسيد الوكلاء.
عصر تحويل النص إلى فيديو
مقاطع من 4-10 ثوان، عروض مبهرة، استخدام عملي محدود
مقاطع بجودة إنتاجية
فيديوهات متماسكة مدتها 60 ثانية، صوت أصلي، تناسق الشخصيات
الوقت الفعلي والتفاعلية
توليد فيديو مباشر للوكلاء والاجتماعات والتطبيقات التفاعلية
النماذج التي تولّد مقاطع جميلة مدتها دقيقتان والنماذج التي تشغّل صورا رمزية مباشرة بمعدل 30 إطارا في الثانية تحل مشكلات مختلفة. PikaStream هو أول دخول جاد في الفئة الثانية، ولن يكون الأخير.
بالنسبة للمبدعين والمطورين، السؤال لم يعد فقط "كيف يمكن أن يبدو الفيديو بالذكاء الاصطناعي؟" بل أصبح "أين يمكن أن يظهر الفيديو بالذكاء الاصطناعي، وماذا يمكنه أن يفعل عندما يصل إلى هناك؟"

تقني إبداعي من لوزان يستكشف نقطة التقاء الذكاء الاصطناعي بالفن. يجرّب النماذج التوليدية بين جلسات الموسيقى الإلكترونية.
View profile →مقالات ذات صلة
تابع الاستكشاف مع هذه المقالات ذات الصلة

وكلاء Luma وصعود تحرير الفيديو الوكيل: الذكاء الاصطناعي يتعلم التوجيه
أطلقت Luma للتو وكلاء ذكاء اصطناعي إبداعيين يوازون بين النصوص والصور والفيديو والصوت. بدعم a16z للمبدأ، تحرير الفيديو الوكيل هو أكبر تحول منذ الفيديو من النص.

بيكا 2.5: إضفاء الطابع الديمقراطي على الفيديو بالذكاء الاصطناعي من خلال السرعة والسعر والأدوات الإبداعية
تطلق شركة بيكا لابز الإصدار 2.5، الذي يجمع بين التوليد الأسرع والفيزياء المحسّنة والأدوات الإبداعية مثل Pikaframes وPikaffects لجعل الفيديو بالذكاء الاصطناعي في متناول الجميع.

أدوات فيديو بالذكاء الاصطناعي مجانية وغير محدودة: ما الذي ينجح في 2026
أدوات الفيديو بالذكاء الاصطناعي المجانية وغير المحدودة تعتمد عادة على قوائم انتظار أو التشغيل المحلي. تعرّف على ما هو غير محدود فعلا، وما الذي يبطئ العمل، وكيف تختار إعدادا عمليا لعام 2026.