米スタートアップのWorld Labsが、1枚の写真からユーザーが操作可能な3Dシーンを生成するAI技術を発表しました。本技術の活用によって、ゲーム開発、デジタルコンテンツ制作の工程やコスト削減等が見込まれています。

今回発表されたWorld LabsのAI技術では、単一の画像から、ユーザーがキーボードとマウスで自由に探索できる3Dシーンを生成することができます。生成されたシーンは、Webブラウザ上でリアルタイムにレンダリングされ、調整可能な被写界深度(DoF)効果も備えています。
このAI技術は「世界モデル」と呼ばれる新しいAIカテゴリーに属しています。World Labsの本技術は従来の同様のモデルが直面していた一貫性や人工物の問題を克服し、生成されたシーンの物理法則を維持する点が特徴的です。例えば、オブジェクトの色変更やダイナミックな照明効果の適用が可能で、シーンの生成後もその状態を保持します。
World Labsは2024年初めに創業。AI研究者として知られるFei-Fei Li氏が立ち上げ、サンフランシスコに拠点を構えています。すでに2億3000万ドルの資金調達に成功しており、主な投資家には、Andreessen Horowitz、Intel Capital、AMD Venturesなどが名を連ねています。
共同創業者のJustin Johnson氏は本技術の意義について、「現在、仮想的でインタラクティブな世界を作るには、何百もの数百万ドルと膨大な開発時間が必要です。我々の技術は、そのプロセスを根本的に変えるでしょう」と語っています。
同社は2025年に最初の製品をリリースすることを目指しており、ビデオゲーム開発者から映画スタジオまで、幅広い業界への展開を視野に入れています。現時点では生成シーンの移動範囲には制限があり、時折レンダリングエラーも発生するものの、同社は「これは初期プレビュー段階であり、今後、さらなる改善を実施する」とコメントしています。
(参考)WorldLabs、TechCrunch
