文章の続きを当てる言語モデルとは違い、世界モデルは物理的な動きや空間の一貫性を予測しようとする研究の方向です。ロボットや自動運転、ゲーム環境の生成などに応用が広がっています。
文章の続きを当てる言語モデルとは違い、世界モデルは物理的な動きや空間の一貫性を予測しようとする研究の方向です。ロボットや自動運転、ゲーム環境の生成などに応用が広がっています。
Google DeepMind の Genie 系や NVIDIA の Cosmos など、2026 年に発表が相次ぐ分野です。「言語モデルの次」を語る記事でよく引き合いに出されます。
人物が頭の中で「もし〜したらこう動く」と未来の展開をシミュレーションする様子。隣に、同じ人物が言葉の続きだけを当てている対比コマを置く
擬人化ポンチ絵 · 後日差し込み次に何が起きるかを内部で予測する仕組みです。
行動する前に結果を試算でき、失敗を減らせます。
研究の路線が割れており、まだ定説がありません。
ロボットや自動運転、ゲーム環境の開発で使われます。
言語モデルとの違いだけ押さえれば十分です。
LLM、AGI、Transformer
「映像そのものを生成すべきか、抽象的な表現を予測すべきか」は研究者の間でも意見が分かれています。