1754534066
2025-08-06 11:45:00
今日、Googleは、シンプルなテキストまたは画像プロンプトからインタラクティブでプレイ可能な世界を生成できる画期的なAIモデルである最新の作成であるGenie 3を発表しました。これは、生成AIでの大きな前進であり、静的な画像とテキストを超えて実際に探索できる動的環境を作成します。
GoogleのDeepmindチームからのこの新しいテクノロジーは、私たちが「世界モデル」と呼ぶものの新しいフロンティアを表しています。基本的に、それは私たちの世界がどのように機能するかを理解し、その場でそれの仮想バージョンを作成できるAIです。
「輝くキノコと隠された川の魔法の森」を入力して、すぐにその世界で歩き回ることができると想像してください。それがGenie 3の約束であり、高度なコーディングスキルを持っている人だけでなく、すべての人のための仮想体験の作成を民主化することです。
潜在的なアプリケーションは、ユニークなビデオゲームレベルの作成から、現実世界で展開される前に、シミュレートされたシナリオの膨大な配列でロボットエージェントのトレーニングまで、驚異的です。
Google DeepMindは、これが人工一般情報(AGI)への道の重要なステップであると言います。
「今日、私たちは、インタラクティブ環境の前例のない多様性を生み出すことができる汎用の世界モデルであるGenie 3を発表しています。世界モデルは、AGIへの道の重要な足がかりでもあります。
Google DeepMind
Genie 3とは何ですか?
Genie 3は、その場でインタラクティブな環境の膨大な配列を生成するために設計された汎用の世界モデルです。テキストのプロンプトが必要で、720pの解像度で航行可能な世界を作成し、数分間続く一貫性が続き、1秒あたり24フレームでスムーズに実行されます。これにより、自然の生態系からアニメーション化されたファンタジーまで、すべてをシミュレートするのに最適です。
このモデルは、照明や水などの物理的特性のモデリングに優れているが、架空の環境や歴史的設定での複雑な相互作用も処理します。ユーザーは、これらの世界を本物であるかのように探求することができ、より没入感のあるAI体験への重要なステップをマークすることができます。 DeepMindは、AIシステムの無制限のトレーニンググラウンドを作成するためのツールとして配置します。
Genie 3はどのように機能しますか?
Genie 3は、そのコアでは、自動回帰生成を使用して各フレームを順番に構築し、過去のアクションとユーザー入力をリアルタイムの応答性を考慮します。これは、1分後にスポットを再検討している場合、モデルは以前から詳細を思い出して維持することを意味します。これは、環境が時間の経過とともに不満を抱かないようにするための賢い方法です。
傑出した機能は、天気の変化や新しいキャラクターの追加など、テキストコマンドがシーンを変更できる迅速な世界イベントです。これにより、基本的なナビゲーションを超えてインタラクティブ性のレイヤーが追加されます。
では、実際にどのように機能しますか?
環境の一貫性
Genie 3は世界を数分間安定させ、要素が視界から外れて移動しても視覚的なメモリを持ち続け、トレーニングから自然に現れます。
リアルタイムインタラクション
Genie 3は、ユーザーが生成された世界とリアルタイムでやり取りできるようにする最初のものであり、以前のバージョンよりも大幅に改善されています。
印象的なパフォーマンス
このモデルは、これらの動的な世界を生成し、720pの解像度で毎秒24フレームで一貫性を維持することができ、体験が流動的で反応性が高いと感じます。
このテクノロジーは、ゲーム開発を根本的に変化させ、開発者がアイデアを迅速にプロトタイプするか、ゲームにプレイヤーの新しいコンテンツを際限なく生成できるようにすることができます。それは、ストーリーテラー、芸術家、教育者のために創造的な可能性の世界を開きます。
GoogleのDeepmindは、可能性のビデオウォークスルーを公開しましたが、それは驚くべきことです。
これは文字通り、ゲームの未来かもしれません。
あなたがそれを手に入れることができるときに関しては、GoogleはGenie 3の公開リリース日をまだ発表していません。今のところ、それは引き続き研究プロジェクトですが、コンテンツ作成の未来のエキサイティングな絵を描くものです。
詳細については、Google DeepMindブログをご覧ください
#Googleの新しいAIGenie #3は単一のプロンプトから再生可能なビデオゲームを生成できます