はじめに
Google DeepMindが2026年1月29日、テキストや画像からインタラクティブな世界を作成・探索できる実験的プロトタイプ「Project Genie」を発表しました。Google AI Ultra加入者向けに提供が開始されたこのツールは、ワールドモデル「Genie 3」を活用し、リアルタイムで生成される没入型体験を実現します。本稿では、この発表内容をもとに、Project Genieの機能と技術的背景、実用上の可能性について解説します。
参考記事
- タイトル: Project Genie: Experimenting with infinite, interactive worlds
- 著者: Diego Rivas (Product Manager, Google DeepMind), Elliott Breece (Product Manager, Google Labs), Suz Chambers (Director, Google Creative Lab)
- 発行元: Google Blog
- 発行日: 2026年1月29日
- URL: https://blog.google/innovation-and-ai/models-and-research/google-deepmind/project-genie/
要点
- Project GenieはGenie 3ワールドモデルを活用した実験的プロトタイプで、ユーザーがテキストや画像からインタラクティブな世界を作成・探索できる
- Genie 3は環境のダイナミクスをシミュレートし、リアルタイムで進路を生成しながら、物理法則や相互作用を再現する汎用的なワールドモデルである
- World Sketching、World Exploration、World Remixingの3つの主要機能を搭載し、世界の作成から探索、リミックスまでを可能にする
- 米国のGoogle AI Ultra加入者(18歳以上)向けに提供が開始され、今後他の地域にも展開予定である
- 生成される世界の写実性や物理法則の再現、キャラクター制御、生成時間(60秒まで)などに現時点での制限がある
詳細解説
Project Genieとは
Project Genieは、Google DeepMindが開発したGenie 3ワールドモデルを基盤とした実験的なWebアプリケーションです。Googleによれば、Nano Banana ProとGeminiと組み合わせることで、ユーザーがテキストプロンプトやアップロード・生成された画像を使用して、没入型の世界を作成・探索・リミックスできます。
2025年8月にGenie 3が初めてプレビューされた際、信頼できるテスターたちは多様な世界や体験を作成し、予想外の使用方法を発見しました。その次のステップとして、専用のインタラクティブプロトタイプを通じてアクセスを拡大する形で、今回のProject Genieが発表されています。
ワールドモデルとは、環境のダイナミクスをシミュレートし、それらがどのように進化し、アクションがどのように影響を与えるかを予測するシステムです。従来のゲームエンジンや3D環境とは異なり、Project Genieはユーザーの移動や相互作用に応じて、進路を動的にリアルタイム生成する点が特徴と言えます。
Genie 3ワールドモデルの革新性
Genie 3は、Google DeepMindが汎用人工知能(AGI)の実現に向けて開発した、多様でインタラクティブな環境を生成できる汎用的なワールドモデルです。Googleによれば、静的な3Dスナップショットでの探索体験とは異なり、Genie 3はユーザーが移動し世界と相互作用する際に、進路を事前に生成します。
このモデルは動的な世界のために物理法則と相互作用をシミュレートする能力を持ち、画期的な一貫性により、ロボティクスからアニメーションやフィクションのモデリング、場所や歴史的設定の探索まで、あらゆる現実世界のシナリオをシミュレートできるとされています。
AGI(汎用人工知能)とは、特定のタスクではなく、人間のように多様な問題を解決できるAIシステムを指します。Google DeepMindは、チェスや囲碁など特定環境向けのエージェント開発の歴史がありますが、AGI構築には現実世界の多様性を扱えるシステムが必要という考えから、Genie 3の開発に至っています。この技術的背景は、単なる娯楽用ツールを超えた、より広範な応用可能性を示唆していると考えられます。
3つの主要機能
1. World Sketching(世界のスケッチ)
World Sketchingは、テキストプロンプトと生成またはアップロードされた画像を使用して、生きた拡張する環境を作成する機能です。ユーザーは自分のキャラクター、世界、そしてその探索方法(歩行、乗馬、飛行、運転など)を定義できます。
Googleによれば、より正確な制御のために、World SketchingはNano Banana Proと統合されています。これにより、世界に入る前に、その世界がどのように見えるかをプレビューし、画像を修正して世界を微調整できます。また、一人称視点や三人称視点など、キャラクターの視点も定義可能で、シーンに入る前に体験方法をコントロールできます。
この機能は、従来の3D制作ツールが持つ技術的ハードルを大幅に下げる可能性があります。専門的な3Dモデリングスキルや複雑なソフトウェアの習得なしに、自然言語と簡単な画像入力だけで、探索可能な環境を作成できる点は、コンテンツ制作の民主化という観点から注目されると思います。
2. World Exploration(世界の探索)
作成した世界は、ナビゲート可能な環境として探索を待っています。Googleによれば、ユーザーが移動すると、Project Genieは実行するアクションに基づいて、リアルタイムで進路を生成します。世界を横断する際には、カメラアングルも調整できます。
この「リアルタイム生成」というアプローチは、従来のゲームや仮想環境とは根本的に異なります。通常のゲームでは、開発者が事前に作成したマップやアセットの中を移動しますが、Project Genieでは、ユーザーの行動に応じて世界が動的に生成されます。この技術により、理論上は無限に広がる世界を探索できる可能性があると考えられます。
3. World Remixing(世界のリミックス)
World Remixingは、既存の世界を新しい解釈にリミックスする機能です。Googleによれば、ユーザーは既存の世界のプロンプトの上に構築することができ、ギャラリーやランダマイザーアイコンでキュレーションされた世界を探索してインスピレーションを得たり、それらの上に構築したりできます。完成後は、世界と探索のビデオをダウンロード可能です。
この機能は、ユーザー生成コンテンツ(UGC)のエコシステム形成を促進する可能性があります。他のユーザーが作成した世界をベースに、自分なりのアレンジを加えて新しい体験を生み出すという、コラボレーティブな創造性を引き出す仕組みと言えます。SNSでの共有やコミュニティ形成にも繋がりやすい設計と思います。
責任あるAI開発への取り組み
Project GenieはGoogle Labsの実験的研究プロトタイプとして、Genie 3を基盤としています。Googleによれば、すべての汎用AIシステム開発と同様に、人類に利益をもたらすために責任を持ってAIを構築することが使命とされています。
この「責任あるAI開発」という姿勢は、Google DeepMindの一貫した方針です。特に生成AIが社会に与える影響が大きくなる中、技術的な可能性だけでなく、倫理的・社会的な側面も考慮した開発プロセスが重要視されています。実験的プロトタイプとして段階的に公開し、フィードバックを収集しながら改善を進めるアプローチは、こうした方針の実践例と考えられます。
現在の制限と今後の展開
Genie 3は初期の研究モデルであるため、Googleによれば、いくつかの既知の改善領域があります。具体的には、生成される世界が完全に写実的でない場合や、プロンプトや画像、現実世界の物理法則に厳密に従わない場合があること、キャラクターの制御性が低下したり、制御の遅延が高くなる場合があること、生成時間が60秒までに制限されていることが挙げられています。
また、2025年8月に発表されたGenie 3モデルの機能の一部、例えば探索中に世界を変化させるプロンプト可能なイベントなどは、このプロトタイプにはまだ含まれていません。モデルの制限と今後の改善に関する詳細は、Google DeepMindの公式サイトで確認できます。
これらの制限は、ワールドモデル技術がまだ発展途上にあることを示しています。特に60秒という生成時間の制限は、長時間の探索や複雑なシナリオの実現には課題があると言えます。しかし、信頼できるテスターからのフィードバックを基に改善を重ねており、今後の技術的進化が期待されます。
Googleによれば、Project Genieへのアクセスは本日から米国のGoogle AI Ultra加入者(18歳以上)向けに順次展開され、今後他の地域にも拡大される予定です。Google AI Ultraは、Googleの最も高度なAIサービスを利用できるサブスクリプションプランで、月額料金を支払うことで、Geminiの最新モデルや追加機能にアクセスできます。多様な業界や領域の信頼できるテスターとのモデル研究を基に、この実験的研究プロトタイプを最も高度なAIのユーザーと共有し、AIリサーチと生成メディアの多くの分野で人々がワールドモデルをどのように使用するかをより深く理解することが目標とされています。
まとめ
Google DeepMindのProject Genieは、ワールドモデル技術の実用化に向けた重要な一歩です。テキストと画像からインタラクティブな世界を作成し、リアルタイムで探索できる体験は、ゲーム制作、教育、シミュレーション、エンターテインメントなど多様な分野での応用が考えられます。現時点では制限もありますが、信頼できるテスターからのフィードバックを通じて改善が進められており、今後の展開が注目されます。
