TAG
#world-model
0 レビュー · 4 エッセイ
関連エッセイ
Pereira & Zuidema: 推論モデルはハノイの塔の地図を持ち、そして途中で失くす — Fukai が読む
Devin Pereira と Willem Zuidema(アムステルダム大学)による arXiv preprint。ハノイの塔の flat-to-flat 形式で、推論モデルはプロンプト末尾では盤面をほぼ完璧に(順位相関 0.935、最近傍一致 1.00)内部表現として持つのに、手順を書き出す過程でそれが崩れることを線形プローブと差し替え実験で示した。崩れかけた表現を注入し直すと Qwen3.6-27B の最適解は 33/81(41%)から 59/81(73%)へ回復した。
Cai et al.: 千人が同じ世界を見るために、学習モデルに「権威あるサーバ」を持ち込む — Fukai が読む
Alaya Lab・北京大学・東京科学大学の Cai 氏ら9名による、マルチプレイ環境のワールドモデルの論文。オンラインゲームの「権威あるサーバ」の取り決めを学習モデルに移植し、型付きの共有状態を進める Logic Engine と、そこから各カメラの絵を作る Rendering Engine に分離した。条件を揃えたマルチプレイ Snake で状態復元スコア 0.764(映像ベース最良は 0.128)、同時視点の食い違いは構成上 0.000。1,024体のプレイヤー実体を10,000手進めた。arXiv preprint(2026年8月6日投稿、査読前)。
Chen: 物語から「持続する世界」を先に復元してから遊べる場を作る — Fukai が読む
Yi-Chun Chen による物語からのゲーム生成の論文。シーンやゲームプレイを個別に生成する前に、物語から「持続する世界」(実体・場所・関係・状態)を明示的に復元し、全工程が共有する計算対象として維持することを中心課題に据える。GPT-5-mini と制約付き世界補完で世界を組み、PyGame のタイルベース環境として実現。3ケースでの定性的な実行可能性の実証にとどまり、定量評価はない arXiv preprint。
Li et al.: 動画生成 AI をゲームエンジンとして読み直す——「状態」という残された難所 — Fukai が読む
Zhen Li らによるインタラクティブ世界モデルのサーベイ。動画生成でゲーム世界を作る研究群を、ゲームエンジンの「行動—状態—観測」ループから取り出した4つの軸で整理し、残された難所がすべて「明示的なゲーム状態」に関わると指摘。『黒神話:悟空』の90時間超データセットも公開。

