تحديثات المنتج

PixVerse تقدّم R2، وتدفع نموذج العالم في الوقت الفعلي نحو عوالم مستمرة وقابلة للعب

PixVerse تقدّم R2، وتدفع نموذج العالم في الوقت الفعلي نحو عوالم مستمرة وقابلة للعب

عادةً ما يكون توليد الفيديو بالذكاء الاصطناعي عملية من لقطة واحدة. يتلقى النموذج مطالبة، ويولّد مقطعًا ثابتًا، ثم يتوقف. ولإجراء تغييرات، يتعين على المستخدم البدء من جديد بمطالبة جديدة ومقطع جديد. كل نتيجة مغلقة ومنفصلة.

يعمل نموذج العالم في الوقت الفعلي بطريقة مختلفة. فبدلًا من إرجاع مقطع، يولّد عالمًا يستمر في العمل بينما يكون المستخدم داخله. يمكن التنقل في العالم في الوقت الفعلي. تصل مدخلات جديدة بينما لا يزال النموذج يولّد، وتغيّر ما يحدث بعد ذلك. لا يُعاد ضبط العالم بين الأفعال، ويحتفظ بحالته طوال الوقت، ويبقى متسقًا كلما طالت الجلسة.

قدّمت PixVerse أول نموذج عالم في الوقت الفعلي في العالم، R1، في يناير 2026. أثبت R1 أن النموذج الفكري قابل للتطبيق: يمكن أن يصبح الفيديو بثًا سمعيًا بصريًا مستمرًا وتفاعليًا بدلًا من مخرج ثابت.

نطلق اليوم R2، وهو ترقية لنموذج العالم في الوقت الفعلي. يظل متماسكًا عبر جلسات أطول بكثير، ويتذكر ما يحدث داخل الجلسة ويحمله إلى الأمام، كما يستقبل النص والمراجع والصوت وعناصر التحكم في الأفعال داخل العالم الجاري نفسه.

عالم يتذكر ويستجيب

التغيير الجوهري في R2 هو ما يستطيع الإدخال أن يفعله. في فيديو الذكاء الاصطناعي العادي، وفي الإصدارات السابقة من التوليد في الوقت الفعلي، يؤثر الإدخال في اللحظة الحالية، ثم تمضي تلك اللحظة. يبدأ الفعل التالي من جديد. لا يحمل العالم شيئًا إلى الأمام.

في R2، يبقى الإدخال قائمًا. فالمطالبة أو الفعل أو الإشارة الصوتية لا تغيّر الإطار الحالي فحسب. إنها تحدّث الحالة الجارية للعالم وتشكّل ما يلي: كيف تتصرف الشخصية لاحقًا، وكيف تُحسم المواقف، وكيف تتطور البيئة مع استمرار الجلسة. يظل الفعل السابق صحيحًا في وقت لاحق من الجلسة نفسها.

استكشف عالمًا حيًا. يدخل اللاعب عالمًا مُولَّدًا ويتحرك داخله في الوقت الفعلي، ويتحكم في شخصية بمفاتيح WASD ويحرّك الكاميرا بمفاتيح الأسهم. تغيّر المطالبات العالم أثناء تقدّم اللاعب، فتضيف عناصر وتعدّل البيئة. تتفاعل الشخصية مع محيطها بقدر من المنطق الفيزيائي، ويبني كل إدخال على سابقه بدلًا من البدء من الصفر.

شكّل القصة. يمكن للعالم أن يطوّر حبكة تنحني وفق ما يفعله اللاعب. في Zero Mark، وهي لعبة فيلم تفاعلية بناها المبدع Xiaolongbao على R2، يعترض مخلوق الطريق ويطلب هدية. وتقديم تنين أو ورقة إليه يؤدي إلى استجابات مختلفة فعلًا. تتفرع القصة من الإدخال بدلًا من اتباع مسار مكتوب مسبقًا، ويولّد النموذج كل نتيجة مباشرة.

في Zero Mark، يأخذ اللقاء نفسه مسارين: تقديم تنين للمخلوق وتقديم ورقة له ينتجان استجابات مختلفة، تُولَّد مباشرة.

في Zero Mark، يأخذ اللقاء نفسه مسارين: تقديم تنين للمخلوق وتقديم ورقة له ينتجان استجابات مختلفة، تُولَّد مباشرة.

شخصيات تستجيب في السياق. يمكن للشخصيات في العالم أن تفهم اللاعب وتستجيب بما يتماشى مع القصة. في إحدى القصص التفاعلية التي بنتها المبدعة Jade Wu على R2، يتحدث اللاعبون مع شخصية اسمها Eve تحتفظ بالهوية والذاكرة عبر الحوار، وتستخرج الأدلة وتدفع الحبكة إلى الأمام. تتتبع ردودها وتعبيرها وحركتها كلًا من الحوار حتى تلك اللحظة والموضع الذي بلغته القصة. تحتفظ بهوية متسقة عبر تبادلات كثيرة بدلًا من إعادة الضبط، فتبدو أقل كشخصية غير لاعبة مكتوبة مسبقًا وأكثر كشخص يعرفك ويتابع ما يحدث.

مشكلة التوسّع وجواب R2

على خلاف توليد مقطع فيديو ثابت، حيث يتلقى النموذج مطالبة واحدة ومدة زمنية ثابتة لملئها، لا يملك العالم الذي يستمر في العمل مثل هذا الحد. عليه أن يفعل عدة أشياء في آن واحد، باستمرار، ومن دون أن ينكسر:

  • البقاء متماسكًا عبر الزمن. يجب أن تبقى الشخصية والمكان وقواعد العالم كما هي. كل ثانية إضافية من وقت التشغيل فرصة أخرى للانحراف.
  • قبول الإدخال أثناء التوليد. لا يستطيع النموذج التوقف للتفكير. تصل عناصر تحكم جديدة بينما العالم في حركة، ويجب دمجها من دون توقف.
  • التذكر والتصحيح. يجب على النموذج أن يحمل إلى الأمام ما حدث بالفعل، وعندما تتراكم أخطاء صغيرة عبر جلسة طويلة، يصححها بدلًا من مضاعفتها.
  • فعل كل ذلك مباشرة. يجب أن تبقى ميزانية زمن الاستجابة ضيقة بما يكفي ليشعر التفاعل بأنه فوري.

تحت هذه المتطلبات يكمن توتر أعمق. الطريقة المعتادة لجعل النموذج سريعًا بما يكفي للوقت الفعلي هي تبسيطه، والطريقة المعتادة لجعله أكثر قدرة هي جعله أثقل وأبطأ. تسحب السرعة والقدرة كل منهما في اتجاه معاكس. والطريقة القياسية التي بنى بها المجال هذه الأنظمة تضاعف المشكلة: سلسلة طويلة من مراحل تدريب منفصلة، تسلم كل منها إلى التالية، مع تآكل الجودة والاستقرار عند كل تسليم.

جواب R2 هو التوقف عن فرض الاختيار بين السرعة والقدرة، وتقسيم العمل إلى مرحلتين مبنيتين على الأساس نفسه. Omni Causal AR هو محرك القدرة، ويعمل كعمود فقري يُدرَّب باستمرار. فهو ينمّي نموذجًا سببيًا واحدًا يواصل التعلم عبر مزيد من البيانات وأنواع المدخلات والمهام والمدد الزمنية الأطول، فيراكم القدرة في مكان واحد بدلًا من تدهورها عبر عمليات التسليم.

ثم تأخذ طبقة التسريع في الوقت الفعلي ذلك النموذج نفسه وتضغطه ليعمل مباشرة بدلًا من تدريب نموذج سريع منفصل من الصفر، بحيث لا تعود مكاسب القدرة على حساب السرعة.

كيف يستبدل R2 خط أنابيب التدريب التقليدي متعدد الخطوات، حيث تتآكل الجودة عند كل تسليم، بنموذج واحد يُدرَّب باستمرار ويُضغط للاستخدام في الوقت الفعلي.

كيف يستبدل R2 خط أنابيب التدريب التقليدي متعدد الخطوات، حيث تتآكل الجودة عند كل تسليم، بنموذج واحد يُدرَّب باستمرار ويُضغط للاستخدام في الوقت الفعلي.

حول هاتين المرحلتين توجد مجموعة من الخيارات الهندسية الموجّهة التي تتيح لكل مكسب في القدرة أن يصل إلى المنتج في الوقت الفعلي. يتضمن التقرير التقني لـ PixVerse R2 الكامل تفاصيل البنية والتقييم.

«أظهرت النماذج اللغوية الكبيرة أن التوسّع مسار موثوق نحو القدرة»، قال Changhu Wang، الشريك المؤسس والرئيس التنفيذي لـ PixVerse. «R2 هو حالتنا التي تثبت أن نماذج العالم في الوقت الفعلي يمكنها اتباع مسار مشابه: فبالبنية المناسبة، يستطيع النموذج أن يواصل اكتساب مزيد من القدرة من دون التخلي عن التفاعل في الوقت الفعلي. ومع الوقت، هكذا تتحول أداة إنشاء إلى بيئة يستطيع الناس دخولها وتشكيلها.»

من نموذج العالم إلى ألعاب قابلة للعب

تجاوز R2 مرحلة العرض البحثي إلى شيء يمكن بناء منتجات حقيقية عليه. أُطلق محرك ألعاب PixVerse أول مرة في يوليو 2026، ويعمل الآن على R2.

Chow Li، رئيس PixVerse Games، يقدّم محرك الألعاب في الوقت الفعلي من PixVerse في مؤتمر Tech in Asia، سبتمبر 2026.

Chow Li، رئيس PixVerse Games، يقدّم محرك الألعاب في الوقت الفعلي من PixVerse في مؤتمر Tech in Asia، سبتمبر 2026.

في عرضه خلال مؤتمر Tech in Asia في سبتمبر، صاغ رئيس الألعاب في PixVerse، Chow Li، الأمر بوصفه تحولًا في ما يمكن أن تكون عليه اللعبة. العناصر التي جعلت اللعبة لعبة تقليديًا—الشخصيات والعوالم والخيارات التي يتخذها اللاعب—تتوقف عن كونها أصولًا ثابتة تُبنى مسبقًا. يستطيع اللاعب الآن أن يقول ما يريده ويراه يحدث، وتتشكل التجربة من خلال اللعب بدلًا من أن تُؤلَّف قبل ذلك. يصبح إنشاء العالم ولعبه الفعل نفسه.

Jaden Xie، الشريك المؤسس ورئيس PixVerse، يتحدث في حلقة نقاش في Google AI App Day في سنغافورة، سبتمبر 2026.

Jaden Xie، الشريك المؤسس ورئيس PixVerse، يتحدث في حلقة نقاش في Google AI App Day في سنغافورة، سبتمبر 2026.

وفي حديثه خلال حلقة نقاش في Google AI App Day في سنغافورة، أشار الشريك المؤسس والرئيس Jaden Xie إلى التقدم في نماذج الفيديو بوصفه دافعًا قويًا للموجة التالية من الألعاب الأصلية للذكاء الاصطناعي. «المثير هو ما كان المبدعون يبنونه على نموذج العالم لدينا منذ أن فتحنا النسخة التجريبية في يوليو»، قال Jaden. «نؤمن بأن نماذج الفيديو لدينا ستمكّن مزيدًا من المبدعين من تحويل أفكارهم إلى واقع.»

التوفر

مجموعة من هذه العوالم مفتوحة الآن للاستكشاف على world.pixverse.video.

نبذة عن PixVerse

PixVerse منصة عالمية لتوليد الفيديو بالذكاء الاصطناعي يثق بها أكثر من 150 مليون مستخدم في أكثر من 177 دولة. وبمجموعة من النماذج الخاصة المطوَّرة بالكامل داخليًا، تمكّن PixVerse أي شخص من إنشاء فيديو بجودة سينمائية من مطالبة أو صورة أو مقطع. في يناير 2026، أطلقت PixVerse نموذج R1، أول نموذج عالم في الوقت الفعلي في العالم، محوّلةً الفيديو إلى بث لا نهائي ومستمر وتفاعلي. يبني R2 على ذلك الأساس، ويوسّع نموذج العالم في الوقت الفعلي لتشغيل جلسات أطول وأكثر تماسكًا. وبفرق موزعة عبر آسيا والولايات المتحدة، تأسست PixVerse في عام 2023 بالتزام جعل الفيديو اللغة العالمية للتعبير البشري. في مارس 2026، أغلقت PixVerse جولة Series C، وبلغت وضع اليونيكورن. لمزيد من المعلومات، تفضل بزيارة pixverse.ai.

موارد ذات صلة

المصدر الرسمي: PixVerse.