見出し画像

【世界生成AI爆誕】World Labsで「想像」の中を歩く。テキストから3D世界が生まれる瞬間

生成AIでテキストや画像を作るのって、もうすっかり日常になったよね。

キーボードを叩けば、一瞬で美しい絵画や小説が生まれる。それは魔法のような体験だ。

でも、画面の中の「平らな情報」に、少し物足りなさを感じることはないかな?

僕たちが生きているのは3Dの空間なのに、AIがくれるのは2Dの答えばかりだなんて、ちょっと不自然だと思わない?

実は今、AIの世界では「言葉」の次に「空間」を理解させようとする、とてつもない競争が始まっているんだ。

その中心にいるのが、今のAIブームの火付け役とも言える「AIのゴッドマザー」、Fei-Fei Li氏だ。

彼女が立ち上げた新会社「World Labs」が、とんでもないものを出してきたよ。

今回は、彼女たちが発表した初のプロダクト「Marble」と、それが切り開く「World Model(世界モデル)」という新しい概念について、その仕組みから未来への影響までじっくり解説していくね。

AIはついに「読む」段階を終えて、「世界を体験する」段階へ進化しようとしている。

その衝撃に備えて、心の準備をしておこう。

テキストから「世界」が生まれる衝撃。World Labs第一弾「Marble」の全貌

まずは、World Labsが発表したプロダクト「Marble」について、その中身を解剖していこう。

一言で言うと、これは「テキストや画像から、歩き回れる3D世界を一瞬で作るツール」だ。

今までも「テキストから3Dモデルを作るAI」はあったけれど、それはあくまで「椅子」や「キャラクター」といった単体のオブジェクトを作るものだった。

でもMarbleが画期的なのは、「世界(Environment)」そのものを生成するところにあるんだ。

しかも、ただの背景画像じゃない。その中に入り込んで、視点を変えたり、奥へ進んだりできる「永続的な(Persistent)3D空間」なんだよ。

🚀 ただの3D生成じゃない。「歩き回れる」という革命

Marbleのすごさは、そのマルチモーダルな入力にある。

受け付けるのはテキストだけじゃないんだ。

  • テキストプロンプト: 「薄暗いサイバーパンク風の路地裏」と打てば、その情景が立体的に立ち上がる。

  • 画像(写真・イラスト): 思い出の旅行写真や、描いたコンセプトアートを読み込ませれば、その「向こう側」の世界までAIが想像して3D化してくれる。

  • 動画: ショート動画から、そのシーンの空間的な再構成を行うことだってできる。

  • ラフな3Dレイアウト: 「ここに箱、ここに床」といった単純なブロック配置から、ディテールの詰まったリアルな空間を肉付けすることも可能だ。

この動画を見ると分かるけど、静止画だったはずの風景の中をカメラがぐんぐん進んでいく様子は、脳がバグるような感覚になるよ。

生成された世界は、Gaussian Splats(ガウシアン・スプラッティング)やメッシュとしてエクスポートできるから、UnityやUnreal Engineといったゲームエンジンにそのまま持ち込んで、ゲームのステージとして使うことだってできるんだ。

🛠️ 「Chisel」で削り出し、言葉で彩る。直感的なクリエイティブ

「でも、AIが作った世界って、細かい修正ができないんでしょ?」

そう思った鋭い君に伝えたいのが、Marbleの強力な編集機能だ。

生成して終わり、じゃないんだよ。

Marbleには、生成された世界を後から自然言語で編集できる機能が備わっている。

「このテーブルを木製に変えて」「夜ではなく夕方にして」と言えば、AIがその意図を理解して空間を書き換えてくれる。

さらに面白いのが、「Chisel(チゼル)」と呼ばれる機能だ。

これは彫刻刀(Chisel)のように、大まかな形やレイアウトを人間が指定して、そこにAIがスタイルを乗せるワークフローを実現するもの。

「構造(レイアウト)」と「見た目(スタイル)」を分離して扱えるから、プロのクリエイターが「ここは通れるようにしたい」「ここは壁にしたい」といったレベルデザインの意図を反映させやすいんだ。

これ、ゲーム開発者や建築デザイナーにとっては、まさに「魔法の杖」だよね。

プリビズ(試作)を作る時間が劇的に短縮されるし、個人クリエイターでもAAA級の背景グラフィックを作れる可能性が出てきたわけだ。

「読むAI」から「体験するAI」へ。World Modelが描く知能の進化地図

さて、ここからが少し深い話。

Fei-Fei Li氏は、なぜ便利な3Dツールを作るために会社を立ち上げたんだろう?

答えは、彼女が目指しているのが単なるツールではなく、「Large World Models(LWMs:大規模世界モデル)」だからだ。

🧠 言葉の確率論を超えて。AIが「コップが割れる」を理解する日

僕たちが普段使っているChatGPTなどのLLM(大規模言語モデル)は、膨大なテキストデータを学習して「言葉の確率」を予測している。

「コップを落としたら」の後に「割れる」という言葉が続く可能性が高いことは知っているけれど、物理的にコップが割れる現象そのものを理解しているわけではないんだ。

いわば、「言葉で記述された世界」しか知らない状態だね。

対して、World Labsが提唱するLWMは、「世界の物理法則や因果関係」を学習しようとしている。

3D空間、物理的な挙動、時間の流れといったデータを学習することで、「この物体は重いから速く落ちる」「この空間は狭いから通れない」といったことをシミュレーションできるようになる。

  • LLM(言葉の脳): テキストを通じて世界を記述する。

  • LWM(空間の脳): 3D空間を通じて世界をシミュレーションする。

これが実現すると、AIは「読む」段階を超えて、「世界を体験する」段階へと進化する。

Fei-Fei Li氏はこの能力を「Spatial Intelligence(空間知能)」と呼んでいるんだ。

🌍 GoogleやNVIDIAも参戦。テック巨人が熱狂する「Spatial Intelligence」

この「空間知能」に注目しているのはWorld Labsだけじゃない。

Google DeepMindの「Genie」や、NVIDIAの「Omniverse」など、テック巨人もこぞってこの領域に投資している。

でも、それぞれの立ち位置は微妙に違うんだ。

  • World Labs (Marble): クリエイター向けの「商用SaaS」として、編集しやすく美しい世界の生成に特化している。

  • Google DeepMind (Genie): ゲーム環境の生成など、どちらかと言えば研究的で、エージェント(AI)の訓練環境としての側面が強い。

  • NVIDIA (Omniverse): 工場や都市のデジタルツインなど、産業用の「超高精度シミュレーション」を目指している。

World Labsは、この中でも「クリエイターが使える実用的な世界モデル」というポジションを狙っているように見えるね。

RunwayやSoraのような動画生成AIが「映像」を作るのに対し、Marbleは「空間」そのものを作る。

この違いは決定的だ。映像は見るだけだけど、空間は探索し、利用できるからだ。

🎩 創造主の民主化。僕たちが「神様視点」を手に入れる未来

ここからは、この技術が僕たちの未来をどう変えるのか、少し俯瞰した視点で考えてみよう。

🤝 クリエイターの役割はどう変わる?「作る」から「指揮する」へ

Marbleのようなツールが普及すると、「3Dモデリング」というスキルの価値が変わっていくはずだ。

これまでは「ポリゴンを一つひとつ組む技術」が重要だったけど、これからは「どんな世界を作りたいか」というビジョンと、「AIにどう指示を出すか」というディレクション能力が問われるようになる。

映画監督がセットの釘を一本一本打たないように、クリエイターはAIという優秀な大工たちを指揮して、壮大な世界を構築する「総監督」のような役割になっていくんじゃないかな。

「神様視点」が民主化される、と言ってもいいかもしれない。

誰でも自分の頭の中にある妄想を、歩き回れる世界として出力して、友達を招待できる。

それって、コミュニケーションの革命だよね。

⚠️ 課題とリスク。リアルすぎる世界で僕たちは何を信じる?

一方で、課題もある。

生成された世界の「物理的な正しさ」はまだ完璧じゃない。

見た目はリアルでも、重力の挙動がおかしかったり、壁をすり抜けたりすることはあるだろう。

ロボットの学習用データとして使うには、まだ厳密さが足りないかもしれない。

それに、権利の問題も複雑だ。

AIが生成した世界の著作権は誰にあるのか?

学習に使われた建築家やアーティストのデザインはどう扱われるのか?

World Labsもこの点には慎重で、クローズドなデータセットの使用など、権利関係には配慮しているようだけど、議論はこれから活発になるだろうね。

製作ノート (Production Note)

「身体」を持つことの意味

記事を書きながらずっと考えていたのは、「知能にとって身体とは何か」ということだ。

僕たち人間は、赤ちゃんに言葉を教える前に、おもちゃを持たせたり、ハイハイさせたりするよね。

物理的な世界とのインタラクション(相互作用)が、知能の発達には不可欠なんだ。

今のAI(LLM)は、いわば「図書館に閉じ込められた天才」。知識は無限にあるけど、リンゴを持った時の重さや、雨に濡れた時の冷たさは知らない。

World Labsの試みは、この天才を外の世界(バーチャル空間)に連れ出す第一歩なんだと思う。

AIが「身体性」を獲得した時、それは人間にとっても、もっと自然で頼れるパートナーになる瞬間なのかもしれない。

まとめ (Conclusion)

今回は、Fei-Fei Li氏率いるWorld Labsの「Marble」と、そこから広がる「World Model」の未来について解説したよ。

  1. Marbleは、テキストや画像から「歩ける3D世界」を生み出す革命的なツール。

  2. その本質は、AIに物理や空間を理解させる「Spatial Intelligence(空間知能)」への挑戦。

  3. クリエイティブの敷居を下げ、AIが現実世界を理解するための「脳」を進化させる。

僕たちが普段使っている生成AIもすごいけど、これからは「空間」という新しい軸が加わることで、もっと立体的で面白い体験が増えていくはずだ。

もしMarbleが一般公開されたら、君はどんな世界を作ってみたい?

「空飛ぶ猫の王国」とか「全部お菓子でできた迷宮」とか、妄想が広がるよね。

ぜひ、君の「作ってみたい世界」のアイデアをコメントで教えてほしいな!

未来のワールドクリエイターは、君かもしれないよ。


君なら、どんな「想像の世界」を歩いてみたい?


Miccell - 妄想が現実になる速度が速すぎて、足元にご注意を!


いいなと思ったら応援しよう!