Googleは、大規模世界モデル「Genie 3」を活用した実験的プロトタイプ「Project Genie」を発表しました。米国のGoogle AI Ultraサブスクリプションを利用している18歳以上のユーザーを対象に提供を開始しました。Google Labsを通じて公開される本プロジェクトは、ユーザーが自らインタラクティブな世界を構築し、探索できるシステムです。
システムにはNano Banana ProやGeminiの技術も搭載されています。中核機能の「World sketching」は、テキストや画像から環境を生成。利用者はキャラクターを作成し、歩く、乗る、飛ぶなどの移動手段を定義できます。一人称や三人称などの視点も細かく制御可能です。自分だけの世界を作り出し、自在に探索できる体験が提供されます。
移動に合わせて進行方向の世界がリアルタイムに生成される機能も特徴です。カメラ角度を調整しながら、様々な環境を自由に歩き回れます。既存の世界をプロンプトに基づき別の解釈へ作り変える機能も備えています。作成した世界は最大60秒の動画として保存し、共有できます。
新モデルは、利用者の操作に対して秒間24フレームでリアルタイムに応答し、世界の一貫性を数分間維持できるよう性能が向上しました。水や光の物理特性、生態系や動植物などの自然要素をシミュレートします。アニメ風や歴史的な設定など、多様な世界観を高い一貫性で再現可能です。Google DeepMindはこの技術を、汎用人工知能の開発に役立てようとしています。
自律動作するAIエージェントの訓練など、教育分野での活用も期待されています。テキストで天候変化や物体の追加を指示できる仕組みも導入されました。これにより、生成された環境をより柔軟に変化させられます。一方で本プロジェクトは研究段階であり、物理法則の正確性が不十分であったり、操作に遅延が発生するという制限があります。
キャラクター制御の難しさや、現時点での生成時間が60秒間に制限されている点も課題です。行動できる範囲についても、改善が必要な事項として挙げられています。Googleは今後、提供地域を順次拡大し、利用者からのフィードバックを収集する方針です。誰もが無限に生成される世界を体験できる未来を目指し、技術の向上と開発を継続していくとしています。
参考
もぐら関連記事




