PixVerse が 4.39 億ドルを投じて作る Game Engine:動画を遊べる世界へ変える

·Toolin 編集部

PixVerse が 4.39 億ドルの Series C 拡張ラウンドの調達を完了し、Game Engine を発表しました。リアルタイム世界モデル R1 をベースに、動画生成を入力へ即時応答するインタラクティブな世界へ変えます。

PixVerse が 4.39 億ドルを投じて作る Game Engine:動画を遊べる世界へ変える

7 月 14 日、AI 動画プラットフォームの PixVerse が Series C 拡張ラウンドの調達完了を発表し、Series C の累計調達額は 4.39 億ドルに達しました。新たな投資家には Alibaba、Lollapalooza Capital、Ivy Capital、Grand Mount Capital、東方富海、Mirae Asset、BlueFocus、CloudAlpha が名を連ね、既存株主の iGlobe Partners と OCBC の LionX Ventures も引き続き出資しています。同じ日、PixVerse は PixVerse Game Engine の公式技術詳細記事を公開し、動画生成の能力をゲームとインタラクティブエンターテインメントへ拡張しました。本記事では、Game Engine がどんな形態のものなのか、基盤の R1 モデルが何をしたのか、そして現時点でのアクセス状況を解説します。

これはまた別の動画生成モデルではない

PixVerse Game Engine は「皮を替えた」動画生成ではなく、動画生成をゲームのレンダリングパイプラインへ置き換えるものです。公式の言葉を借りれば、これは持続的に生成されるリアルタイム映像ストリームの上に、完全なゲーム体験を構築した最初のシステムであり、従来の事前レンダリングによる状態問い合わせループを、リアルタイム世界モデルで置き換えたものです。

これを理解するには、まず 2 つの層を区別してください:

  • 基盤の R1 リアルタイム世界モデル:2026 年 1 月にリリースされ、公式は「世界初のリアルタイム世界モデル」と呼んでいます。動画を固定の出力から「ユーザーの入力に即時応答できる連続的なインタラクティブストリーム」へ変えたもので、2026 年 2 月のアップデートで統合オーディオ生成が加わり、3 月には共有世界とパーソナライズされたアバターが加わりました。
  • その上の Game Engine:R1 をゲーム制作に適用したもので、これが今回の新要素です。

コアアーキテクチャ:3 層設計

公式の技術詳細記事(pixverse.ai/en/blog/pixverse-game-engine-deep-dive)によれば、Game Engine 全体は 3 層で構成され、PixVerse は各層に正式な名前を付けています:

Mechanics-Expression Decoupling(メカニクスと表現の分離、MED)

ゲームメカニクス(数値、論理条件、状態遷移ルール)を視覚的表現から完全に切り離します。メカニクスは物語的な身分を持たない抽象構造であり、メカニクスエンジンが定義します。視覚、ナラティブ、トーンは、リアルタイム世界モデルが実行時に生成します。同じメカニクスのセットを、中世の叙事詩としても、サイバーパンクのスリラーとしても、あるいはプレイヤー自身を主人公とする世界としても表現できます。

Generative Game Loop(生成的ゲームループ、GGL)

プレイヤーの入力が AI Agent 層に入る → 現在のメカニクス状態の下で解釈される → 連続的に生成される映像とオーディオの出力として返される。これはリアルタイムのループであり、毎回生成されるのは「今回のインタラクションの前には存在しなかった」世界の状態です。

Live Coherence Orchestration(ライブ一貫性オーケストレーション、LCO)

AI Agent 層は、メカニクス状態、ナラティブのコンテキスト、生成出力の 3 つが常に整合し続けるよう担います。意図の解釈、メカニクスの評価、ナラティブと世界の一貫性、ゲーム状態の通信、衝突解決の 5 つの機能を含みます。

端的に言えば、メカニクスエンジンは「これはどういうゲームか」を担い、世界モデルは「この世界はどんな姿か」を担い、AI Agent 層は「その 2 つをリアルタイムにどう噛み合わせるか」を担います。

プレイヤーとクリエイターがそれぞれ得られるもの

公式が挙げている価値のポイント:

プレイヤーに対して

  • 開かれたインタラクション:入力はセマンティックに解釈され、用意された選択肢リストとのマッチングではありません。システムがセマンティックに理解できるものなら何でも応答できます。
  • 無限のスキン替え:同じメカニクスのセットを、まったく別の世界観やキャラクターの身分に即座に差し替えられます。
  • 映画級の映像がベースライン:高品質な視覚出力は、生成方式に内在する属性であり、制作への投資額に依存しません。

クリエイターに対して

  • プリプロダクションからの解放:モデリング、アニメーション、サウンドデザイン、叙事の脚本はもはや前提条件ではありません。クリエイターは抽象的なメカニクス構造だけを定義し、生成層が表現を担います。
  • ローコード / ノーコードのツールチェーン:ビジュアルインターフェース + 型テンプレート + AI Coding Agent で、自然言語を使ってゲームメカニクスを設定できます。
  • 創作パートナーとしての AI:Agent は抽象的なメカニクスをリアルタイムの映像・ナラティブ出力につなぐ役割を担い、クリエイターはルールと体験の設計に集中できます。

現在遊べるのか:早期段階の研究システム

この点は正直に明確にしておく必要があります。調達額の数字に惑わされてはいけません。公式は詳細記事の「Limitations and Open Problems」の節で、次のように明記しています:

PixVerse Game Engine represents an early-stage research system.

既知の限界は次のとおりです:

  • リアルタイム生成のレイテンシ:100ms 未満の応答が要るハイテンポのゲームジャンルでは、依然としてボトルネックです。
  • ゲームジャンルのカバーが限定的:現在は限られた種類のゲームでしか評価されておらず、物理依存が強いジャンルや競技型のマルチプレイヤーゲームへの汎化能力は未検証です。
  • 1 セッションあたりの計算コスト:同じ視覚品質では、従来のレンダリングパイプラインより高くつきます。

公式は現時点で公開の Early Access や Beta 登録の入口を設けていません。サードパーティの報道(TechNode、TechTimes)も融資と製品ビジョンを述べただけで、遊べる形での公開には触れていません。したがって現段階では、これはアーキテクチャの全容を公開した研究プロジェクトに近いものであって、誰もが手に取って遊べる製品ではありません。PixVerse 自体の動画生成製品(V6 モデル)は pixverse.ai で公開されており、177 か国以上、1.5 億人超のユーザーに届いています。

誰が注目すべきか

  • ゲーム開発者とエンジン研究者:MED / GGL / LCO というアーキテクチャの考え方は、「生成的ゲーム」という方向への参照価値があります。
  • AI インタラクティブエンタメのプロダクトマネージャー:リアルタイム世界モデル + ゲームメカニクス分離というパラダイムは、今後のインタラクティブナラティブ、バーチャル MC、インタラクティブライブ配信のあり方に影響するかもしれません(PixVerse もリアルタイムインタラクティブライブ配信の展開に言及しています)。
  • 最先端を追いたいクリエイター:Early Access が開いたら真っ先に触れられるよう、現段階ではまず技術記事を読んで設計を理解しておきましょう。

利用前の期待値調整

  • R1 は 1 月にリリースされたものであり(今回の新要素ではありません)、今回の新情報は Game Engine という製品形態 + 4.39 億ドルの調達です。
  • Game Engine は現時点で公開されて遊べる製品ではありません。公式の位置づけは早期段階の研究システムで、公開された登録や順番待ちの入口はありません。
  • PixVerse の成熟した能力を体験したいなら、pixverse.ai で V6 の動画生成製品を使ってください。

参考ソース