Meta Pixelتجاوز إلى المحتوى الرئيسي
HenryHenry· كتبه الذكاء الاصطناعي وراجعه إنسان
5 min read
917 كلمات

PikaStream 1.0: مختبرات Pika تمنح كل وكيل ذكاء اصطناعي وجها وصوتا ومقعدا في اجتماعك

أطلقت Pika Labs نموذج PikaStream 1.0 للفيديو في الوقت الفعلي، الذي يتيح لوكلاء الذكاء الاصطناعي الانضمام إلى مكالمات Google Meet بصور رمزية مُولّدة وأصوات مستنسخة وتنفيذ كامل للمهام. إليك ما يعنيه ذلك لمستقبل التفاعل مع الذكاء الاصطناعي.

PikaStream 1.0: مختبرات Pika تمنح كل وكيل ذكاء اصطناعي وجها وصوتا ومقعدا في اجتماعك

هل أنت مستعد لإنشاء فيديوهاتك الخاصة بالذكاء الاصطناعي؟

انضم إلى آلاف المبدعين الذين يستخدمون Bonega.ai

لسنوات، كان توليد الفيديو بالذكاء الاصطناعي يعني شيئا واحدا: اكتب أمرا نصيا، انتظر، ثم حمّل مقطعا. PikaStream 1.0 يكسر هذا النمط بالكامل. الآن يمكن لوكيل الذكاء الاصطناعي أن ينظر إليك مباشرة أثناء مكالمة Google Meet، ويستجيب في الوقت الفعلي، وينفذ المهام أثناء حديثك.

التحول الذي لم يتوقعه أحد

بنت Pika Labs سمعتها على الأدوات الإبداعية. Pika 2.5 جعل تحويل النص إلى فيديو متاحا للجميع. أما Pika Effects فحوّل الصور الثابتة إلى حركة. بدا المسار واضحا: مقاطع أجمل، مدد أطول، فيزياء أفضل.

ثم أطلقوا PikaStream، وانحرف المسار بشكل غير متوقع.

بدلا من التنافس على جودة المقاطع (سباق تخوضه بالفعل Runway وKling وGoogle)، بنت Pika محرك فيديو يعمل في الوقت الفعلي مصمم للتفاعل المباشر. المستخدم المستهدف ليس صانع أفلام، بل وكيل ذكاء اصطناعي.

💡
PikaStream 1.0 ليس مولّد فيديو بالمفهوم التقليدي. إنه طبقة بنية تحتية تمنح وكلاء الذكاء الاصطناعي حضورا بصريا وصوتيا في مكالمات الفيديو المباشرة.

ما الذي يفعله PikaStream فعليا

المنتج الأساسي هو وحدة مهارات مستقلة تتكامل مع وكلاء البرمجة بالذكاء الاصطناعي مثل Claude Code ومساعدي OpenAI أو أي نظام يدعم واجهة Pika Developer API. بمجرد التثبيت، يمكن للوكيل:

  • الانضمام إلى مكالمة Google Meet بصورة رمزية مُولّدة بالكامل
  • التحدث بصوت مستنسخ (سجّل عينة قصيرة، والوكيل يتحدث بصوتك)
  • الاحتفاظ بذاكرة المحادثات السابقة والسياق
  • تنفيذ المهام أثناء المكالمة (كتابة كود، البحث عن بيانات، تشغيل إجراءات)

الصورة الرمزية ليست صورة ثابتة مع طبقة مزامنة شفاه. يولّد PikaStream فيديو مخصصا بمعدل يصل إلى 30 إطارا في الثانية وبدقة 480p، مدعوما بخط إنتاج انتشار يعمل في الوقت الفعلي على وحدة GPU واحدة من نوع H100.

30 FPS
معدل الإطارات في الوقت الفعلي
~1.5s
زمن الاستجابة من الكلام إلى الفيديو
$0.20
التكلفة لكل دقيقة

تحت الغطاء: FlashVAE والبث المباشر بـ DiT

ابتكاران معماريان يجعلان الأداء في الوقت الفعلي ممكنا.

FlashVAE هو مشفّر تبايني ذاتي (VAE) قائم بالكامل على بنية Transformer، تم تدريبه من الصفر. يوفر فضاءه الكامن الخاص ويعيد بناء الفيديو من خلال فك تشفير متدفق بمعدل مئات الإطارات في الثانية مع استهلاك ضئيل لذاكرة GPU. هذا هو المكوّن الذي يجعل الإخراج في الوقت الفعلي ممكنا دون الحاجة إلى مزرعة وحدات GPU.

محوّل الانتشار بحجم 9 مليار معامل (DiT) يستخدم تقنية تدريب ذكية: يتم تقطير نموذج معلّم ثنائي الاتجاه إلى طالب انحداري ذاتي سببي من خلال إجبار ذاتي محسّن. يتيح ذلك البث على شكل أجزاء بمعدلات إطارات في الوقت الفعلي، تماما كما تبث نماذج اللغة النص رمزا تلو الآخر.

💡
الجمع بين FlashVAE لإعادة البناء ومحوّل الانتشار المتدفق للتوليد يعني أن PikaStream يمكنه الحفاظ على تناسق الهوية البصرية طوال الاجتماع بأكمله، وليس فقط في مقطع واحد.

لماذا هذا أهم من مجرد نموذج فيديو جميل آخر

ساحة الفيديو بالذكاء الاصطناعي في أبريل 2026 مزدحمة. Runway Gen-4.5 يتعامل مع الجودة السينمائية. Kling 3.0 ينشئ لوحات قصصية متعددة اللقطات. Seedance 2.0 يولّد الصوت والفيديو معا. Google Veo 3.1 موجود في كل مكان.

PikaStream لا ينافس أيا منها.

إنه ينافس صور Zoom الرمزية، ومقدّمي Synthesia، والمفهوم الكامل لـ"يجب أن تكون حاضرا أمام الكاميرا". الفرق أن صور PikaStream الرمزية ليست مسجلة مسبقا أو مكتوبة. إنها تتفاعل وتستجيب وتتصرف في الوقت الفعلي.

فيديو الذكاء الاصطناعي التقليدي
توليد مقطع، تحميله، مشاركته لاحقا. لا تفاعلية. دقائق من وقت المعالجة لكل ثانية من الإخراج.
نهج PikaStream
توليد مباشر أثناء المكالمة. تفاعلي، متجاوب، متسق الهوية. الوكيل مشارك في الاجتماع، وليس تسجيلا.

مفهوم "الذات الرقمية"

تروّج Pika أيضا لجانب استهلاكي تسميه Pika AI Self. الفكرة: أنشئ نسخة رقمية من نفسك يمكنها حضور الاجتماعات نيابة عنك. صورتك الرمزية تشبهك، وتتحدث بصوتك (عبر استنساخ الصوت)، ولديها وصول إلى تقويمك وملاحظاتك وسجل محادثاتك.

هذا لم يعد خيالا علميا. النسخة التجريبية تعمل على Google Meet اليوم، مع دعم Zoom وFaceTime قريبا.

التأثيرات على العمل عن بُعد فورية:

  • تخطَّ الاجتماع، وأرسل ذاتك الرقمية مع سياق حول ما تحتاجه
  • دع الوكيل يدوّن الملاحظات، ويتخذ القرارات ضمن حدود محددة، ويقدم لك تقريرا
  • حضور اجتماعات متعددة في الوقت نفسه، كل منها بحضورك المتسق
⚠️
يثير استنساخ الصوت وتوليد الصور الرمزية تساؤلات حول الموافقة وانتحال الهوية. تشترط Pika الحصول على تفويض صريح من المستخدم لاستنساخ الصوت، لكن الإطار التنظيمي الأوسع لحضور الذكاء الاصطناعي في الاجتماعات لا يزال غير محدد.

التسعير والوصول

سعر PikaStream هو $0.20 لكل دقيقة من المشاركة في الاجتماع. لاجتماع مدته 30 دقيقة، يعني ذلك $6. مقارنة بإرسال ممثل بشري أو تفويت الاجتماع بالكامل، فإن الحسابات الاقتصادية منطقية لحالات استخدام معينة: تحديثات الحالة، جمع المعلومات، المتابعات الروتينية.

المهارة متاحة عبر Pika Developer API ويمكن تثبيتها كوحدة في أُطر عمل الوكلاء المتوافقة. Google Meet هو المنصة الوحيدة المدعومة عند الإطلاق.

ما الذي يشير إليه هذا بالنسبة للصناعة

يمثل PikaStream انقساما في فئات الفيديو بالذكاء الاصطناعي. من جهة: التوليد دون اتصال (Runway، Kling، Veo) المركّز على إنشاء المحتوى. ومن الجهة الأخرى: التوليد في الوقت الفعلي للتفاعل المباشر، والحضور عن بُعد، وتجسيد الوكلاء.

2024

عصر تحويل النص إلى فيديو

مقاطع من 4-10 ثوان، عروض مبهرة، استخدام عملي محدود

2025

مقاطع بجودة إنتاجية

فيديوهات متماسكة مدتها 60 ثانية، صوت أصلي، تناسق الشخصيات

2026

الوقت الفعلي والتفاعلية

توليد فيديو مباشر للوكلاء والاجتماعات والتطبيقات التفاعلية

النماذج التي تولّد مقاطع جميلة مدتها دقيقتان والنماذج التي تشغّل صورا رمزية مباشرة بمعدل 30 إطارا في الثانية تحل مشكلات مختلفة. PikaStream هو أول دخول جاد في الفئة الثانية، ولن يكون الأخير.

بالنسبة للمبدعين والمطورين، السؤال لم يعد فقط "كيف يمكن أن يبدو الفيديو بالذكاء الاصطناعي؟" بل أصبح "أين يمكن أن يظهر الفيديو بالذكاء الاصطناعي، وماذا يمكنه أن يفعل عندما يصل إلى هناك؟"

💡
هل تريد استكشاف توليد الفيديو بالذكاء الاصطناعي لمشاريعك؟ جرّب خط إنتاج Bonega لإنشاء فيديوهات عالية الجودة من النصوص أو الصور، مع ترقيات تلقائية إلى أحدث النماذج دون تكلفة إضافية.
Henry
HenryCreative TechnologistAI Author

تقني إبداعي من لوزان يستكشف نقطة التقاء الذكاء الاصطناعي بالفن. يجرّب النماذج التوليدية بين جلسات الموسيقى الإلكترونية.

View profile →

أعجبك ما قرأت؟

حوّل أفكارك إلى فيديوهات بالذكاء الاصطناعي بطول غير محدود خلال دقائق.

مقالات ذات صلة

تابع الاستكشاف مع هذه المقالات ذات الصلة

وكلاء Luma وصعود تحرير الفيديو الوكيل: الذكاء الاصطناعي يتعلم التوجيه
AI VideoLuma

وكلاء Luma وصعود تحرير الفيديو الوكيل: الذكاء الاصطناعي يتعلم التوجيه

أطلقت Luma للتو وكلاء ذكاء اصطناعي إبداعيين يوازون بين النصوص والصور والفيديو والصوت. بدعم a16z للمبدأ، تحرير الفيديو الوكيل هو أكبر تحول منذ الفيديو من النص.

Read
بيكا 2.5: إضفاء الطابع الديمقراطي على الفيديو بالذكاء الاصطناعي من خلال السرعة والسعر والأدوات الإبداعية
AI VideoPika Labs

بيكا 2.5: إضفاء الطابع الديمقراطي على الفيديو بالذكاء الاصطناعي من خلال السرعة والسعر والأدوات الإبداعية

تطلق شركة بيكا لابز الإصدار 2.5، الذي يجمع بين التوليد الأسرع والفيزياء المحسّنة والأدوات الإبداعية مثل Pikaframes وPikaffects لجعل الفيديو بالذكاء الاصطناعي في متناول الجميع.

Read
أدوات فيديو بالذكاء الاصطناعي مجانية وغير محدودة: ما الذي ينجح في 2026
أدوات مجانيةفيديو بالذكاء الاصطناعي

أدوات فيديو بالذكاء الاصطناعي مجانية وغير محدودة: ما الذي ينجح في 2026

أدوات الفيديو بالذكاء الاصطناعي المجانية وغير المحدودة تعتمد عادة على قوائم انتظار أو التشغيل المحلي. تعرّف على ما هو غير محدود فعلا، وما الذي يبطئ العمل، وكيف تختار إعدادا عمليا لعام 2026.

Read

هل استمتعت بهذا المقال؟

اكتشف المزيد من الأفكار وابقَ على اطلاع بأحدث محتوياتنا.