PixVerse Memperkenalkan R2, Memajukan Model Dunia Real-Time-nya Menuju Dunia yang Persisten dan Dapat Dimainkan
Pembuatan video AI biasanya merupakan proses sekali jadi. Sebuah model menerima prompt, menghasilkan klip yang tetap, lalu berhenti. Untuk membuat perubahan, pengguna harus memulai lagi dengan prompt baru dan klip baru. Setiap hasil tertutup dan terpisah.
Model dunia real-time bekerja secara berbeda. Alih-alih mengembalikan sebuah klip, model ini menghasilkan dunia yang terus berjalan saat pengguna berada di dalamnya. Dunia tersebut dapat dijelajahi secara real time. Input baru tiba saat model masih menghasilkan dan mengubah apa yang terjadi selanjutnya. Dunia tidak direset di antara tindakan, dan mempertahankan keadaannya sepanjang waktu, tetap konsisten semakin lama sebuah sesi berjalan.
PixVerse memperkenalkan model dunia real-time pertama di dunia, R1, pada Januari 2026. R1 membuktikan bahwa paradigma tersebut layak: video dapat menjadi aliran audiovisual yang berkelanjutan dan interaktif, bukan keluaran yang tetap.
Hari ini, kami meluncurkan R2, peningkatan pada model dunia real-time. Model ini tetap koheren pada sesi yang jauh lebih panjang, mengingat apa yang terjadi di dalam sebuah sesi dan membawanya ke depan, serta juga menerima teks, referensi, audio, dan kontrol aksi ke dalam dunia yang sama yang sedang berjalan.
Dunia yang Mengingat dan Merespons
Perubahan inti pada R2 adalah apa yang mampu dilakukan oleh input. Dalam video AI biasa, dan pada versi sebelumnya dari pembuatan real-time, input memengaruhi momen saat ini, lalu momen itu berlalu. Tindakan berikutnya dimulai dari awal. Dunia tidak membawa apa pun ke depan.
Pada R2, input bertahan. Sebuah prompt, tindakan, atau isyarat audio tidak hanya mengubah bingkai saat ini. Input tersebut memperbarui keadaan dunia yang sedang berjalan dan membentuk apa yang mengikuti: bagaimana karakter berperilaku kemudian, bagaimana suatu situasi terselesaikan, dan bagaimana lingkungan berkembang seiring sesi berlanjut. Tindakan sebelumnya tetap benar di kemudian hari dalam sesi yang sama.
Jelajahi dunia yang hidup. Seorang pemain memasuki dunia yang dihasilkan dan bergerak melaluinya secara real time, mengendalikan karakter dengan tombol WASD dan menggeser kamera dengan tombol panah. Prompt mengubah dunia saat pemain berjalan, menambahkan elemen dan mengubah lingkungan. Karakter berinteraksi dengan sekitarnya dengan logika fisik, dan setiap input membangun dari yang sebelumnya, bukan memulai dari nol.
Bentuk ceritanya. Dunia dapat mengembangkan alur cerita yang menyesuaikan dengan apa yang dilakukan pemain. Di Zero Mark, permainan film interaktif yang dibangun di atas R2 oleh kreator Xiaolongbao, seekor makhluk menghalangi jalan dan meminta hadiah. Menawarkan naga atau daun menghasilkan respons yang benar-benar berbeda. Cerita bercabang dari input, bukan mengikuti jalur yang sudah tertulis sebelumnya, dan model menghasilkan setiap hasil secara langsung.

Di Zero Mark, pertemuan yang sama mengambil dua jalur: menawarkan naga kepada makhluk dan menawarkan daun menghasilkan respons yang berbeda, dihasilkan secara langsung.
Karakter yang merespons sesuai konteks. Karakter di dunia dapat memahami pemain dan merespons sejalan dengan cerita. Dalam satu cerita interaktif yang dibangun oleh kreator Jade Wu di R2, pemain berbicara dengan karakter bernama Eve yang mempertahankan identitas dan ingatan sepanjang percakapan, menggali petunjuk dan memajukan plot. Balasan, ekspresi, dan gerakannya mengikuti percakapan sejauh ini serta titik yang telah dicapai cerita. Ia mempertahankan identitas yang konsisten di banyak pertukaran, bukan mereset, sehingga terasa kurang seperti karakter non-pemain yang berskrip dan lebih seperti seseorang yang mengenal Anda serta mengikuti apa yang sedang terjadi.
Masalah Penskalaan dan Jawaban R2
Berbeda dari menghasilkan klip video yang tetap, di mana model menerima satu prompt dan rentang waktu tetap untuk diisi, dunia yang terus berjalan tidak memiliki batas seperti itu. Dunia harus melakukan beberapa hal sekaligus, secara berkelanjutan, tanpa terputus:
- Tetap koheren dari waktu ke waktu. Karakter, tempat, dan aturan dunia harus tetap sama. Setiap detik runtime tambahan adalah kesempatan lain untuk menyimpang.
- Menerima input di tengah pembuatan. Model tidak dapat berhenti sejenak untuk berpikir. Kontrol baru tiba saat dunia sedang bergerak dan harus dilipat masuk tanpa berhenti.
- Mengingat dan memulihkan. Model harus membawa ke depan apa yang sudah terjadi, dan ketika kesalahan kecil menumpuk selama sesi yang panjang, memperbaikinya alih-alih memperparahnya.
- Melakukan semua ini secara langsung. Anggaran latensi harus tetap cukup ketat agar terasa interaktif.
Di balik persyaratan ini terdapat ketegangan yang lebih dalam. Cara biasa membuat model cukup cepat untuk real time adalah menyederhanakannya, dan cara biasa membuatnya lebih mampu adalah membuatnya lebih berat dan lebih lambat. Kecepatan dan kemampuan saling tarik-menarik. Cara standar bidang ini membangun sistem tersebut memperparah masalah: rantai panjang tahap pelatihan yang terpisah, masing-masing menyerahkan ke tahap berikutnya, dengan kualitas dan stabilitas yang terkikis di setiap serah terima.
Jawaban R2 adalah berhenti memaksa pilihan antara kecepatan dan kemampuan, lalu membagi pekerjaan menjadi dua tahap yang dibangun di atas fondasi yang sama. Omni Causal AR adalah mesin kemampuan, bertindak seperti tulang punggung yang dilatih secara berkelanjutan. Ia menumbuhkan satu model kausal yang terus belajar di lebih banyak data, lebih banyak jenis input, lebih banyak tugas, dan rentang waktu yang lebih panjang, mengakumulasi kemampuan di satu tempat alih-alih menurun di setiap serah terima.
Lapisan akselerasi real-time kemudian mengambil model yang sama itu dan memampatkannya agar berjalan secara langsung, bukan melatih model cepat yang terpisah dari awal, sehingga peningkatan kemampuan tidak lagi mengorbankan kecepatan.

Bagaimana R2 menggantikan pipeline pelatihan multi-langkah konvensional, di mana kualitas terkikis di setiap serah terima, dengan satu model yang dilatih secara berkelanjutan dan dimampatkan untuk penggunaan real-time.
Di seputar dua tahap ini terdapat serangkaian pilihan rekayasa yang terarah sehingga setiap peningkatan kemampuan terbawa hingga produk real-time. Laporan teknis PixVerse R2 yang lengkap mencakup detail arsitektur dan evaluasi.
“Model bahasa besar menunjukkan bahwa penskalaan adalah jalur yang andal menuju kemampuan,” kata Changhu Wang, salah satu pendiri dan CEO PixVerse. “R2 adalah bukti kami bahwa model dunia real-time dapat mengikuti jalur serupa: dengan arsitektur yang tepat, sebuah model dapat terus menjadi lebih mampu tanpa melepaskan interaksi real-time. Seiring waktu, inilah cara alat kreasi menjadi lingkungan yang dapat dimasuki dan dibentuk orang.”
Dari Model Dunia ke Game yang Dapat Dimainkan
R2 telah beralih dari demonstrasi riset menjadi sesuatu yang dapat menjadi dasar produk nyata. Pertama diluncurkan pada Juli 2026, PixVerse Game Engine kini berjalan di R2.

Chow Li, Kepala PixVerse Games, mempresentasikan mesin game real-time PixVerse di Tech in Asia Conference, September 2026.
Saat presentasi di Tech in Asia Conference pada September, Kepala Games PixVerse, Chow Li, membingkainya sebagai pergeseran tentang apa yang dapat menjadi sebuah game. Bagian-bagian yang secara tradisional membuat sebuah game menjadi game—karakter, dunia, dan pilihan yang dibuat pemain—berhenti menjadi aset tetap yang dibangun sebelumnya. Pemain kini dapat mengatakan apa yang mereka inginkan dan melihatnya terjadi, dan pengalaman terbentuk melalui permainan, bukan ditulis sebelumnya. Menciptakan dunia dan memainkannya menjadi tindakan yang sama.

Jaden Xie, salah satu pendiri dan Presiden PixVerse, berbicara dalam sebuah panel di Google AI App Day di Singapura, September 2026.
Saat berbicara dalam sebuah panel di Google AI App Day di Singapura, salah satu pendiri dan Presiden Jaden Xie menunjuk kemajuan model video sebagai pendorong kuat bagi gelombang berikutnya game yang bersifat AI-native. “Yang menarik adalah apa yang telah dibangun para kreator di model dunia kami sejak kami membuka beta pada Juli,” kata Jaden. “Kami percaya model video kami akan memberdayakan lebih banyak kreator dalam mewujudkan ide mereka.”
Ketersediaan
Kumpulan dunia ini kini terbuka untuk dijelajahi di world.pixverse.video.
Tentang PixVerse
PixVerse adalah platform pembuatan video AI global yang dipercaya oleh lebih dari 150 juta pengguna di 177+ negara. Dengan rangkaian model milik sendiri yang dikembangkan sepenuhnya secara internal, PixVerse memberdayakan siapa pun untuk membuat video berkualitas sinematik dari prompt, foto, atau klip. Pada Januari 2026, PixVerse meluncurkan R1, model dunia real-time pertama di dunia, mengubah video menjadi aliran yang tak terbatas, berkelanjutan, dan interaktif. R2 membangun di atas fondasi itu, menskalakan model dunia real-time agar menjalankan sesi yang lebih panjang dan lebih koheren. Dengan tim yang tersebar di Asia dan AS, PixVerse didirikan pada 2023 dengan komitmen menjadikan video sebagai bahasa universal ekspresi manusia. Pada Maret 2026, PixVerse menutup putaran Seri C-nya dan mencapai status unicorn. Untuk informasi lebih lanjut, kunjungi pixverse.ai.
Sumber Terkait
- PixVerse R2: Menskalakan Model Dunia Omni Real-Time
- Ulasan Mendalam PixVerse Game Engine: Gaming Interaktif Real-Time
- PixVerse Meluncurkan R1: Model Dunia AI Real-Time Pertama
- Jelajahi dunia R2
Sumber resmi: PixVerse.