日本語版
最新ニュース
世界

Google、OpenAIのSoraを破壊するテキスト・トゥ・ビデオのVeo 2を発表

AI の世界では、大規模言語モデルを利用した AI モデルやサービスのアップデートが継続的にリリースされているため、1 日がとても長いように感じられます。 本日の最新開発は Google DeepMind によるもので、人工知能を通じてビデオ作成の状況を変革することを約束する最先端のビデオ生成モデルである Veo 2 を紹介しました。 これは、OpenAI からの Sora の最近のリリースに続くものです。ここ数日間、Sora を使用してきましたが、確かに制限があります (サイコロを振るなどの物理学を理解できないなど)。 高度なビデオ生成 Veo 2 は、ユーザー プロンプトのスタイルとコンテンツに一致するだけでなく、最大 4K の解像度で高品質のビデオ クリップを作成するように設計されています。 Sora の上限が 1080 であることを考えると、この最大品質は重要です。最近のビデオ制作に真剣に取り組んでいる場合、最低は 4K です。そのため、1080 品質を吸収できるプロジェクトはあるかもしれませんが、4K を生成できる GenAI の方が非常に価値があります。 このモデルは、命令が単純であっても複雑であっても解釈することに優れており、現実世界の物理学や多様なビジュアル スタイルをシミュレートするビデオを生成します。…

Google、OpenAIのSoraを破壊するテキスト・トゥ・ビデオのVeo 2を発表

1734429561
2024-12-17 04:21:00

AI の世界では、大規模言語モデルを利用した AI モデルやサービスのアップデートが継続的にリリースされているため、1 日がとても長いように感じられます。

本日の最新開発は Google DeepMind によるもので、人工知能を通じてビデオ作成の状況を変革することを約束する最先端のビデオ生成モデルである Veo 2 を紹介しました。

これは、OpenAI からの Sora の最近のリリースに続くものです。ここ数日間、Sora を使用してきましたが、確かに制限があります (サイコロを振るなどの物理学を理解できないなど)。

高度なビデオ生成

Veo 2 は、ユーザー プロンプトのスタイルとコンテンツに一致するだけでなく、最大 4K の解像度で高品質のビデオ クリップを作成するように設計されています。

Sora の上限が 1080 であることを考えると、この最大品質は重要です。最近のビデオ制作に真剣に取り組んでいる場合、最低は 4K です。そのため、1080 品質を吸収できるプロジェクトはあるかもしれませんが、4K を生成できる GenAI の方が非常に価値があります。

このモデルは、命令が単純であっても複雑であっても解釈することに優れており、現実世界の物理学や多様なビジュアル スタイルをシミュレートするビデオを生成します。 Veo 2 の特徴は、高レベルのディテール、リアリズムを維持し、アーティファクトを最小限に抑える能力であり、これにより、以前の AI ビデオ モデルと比較して、よりプロフェッショナル グレードの出力が提供されます。

このモデルの優れた能力は、ワイド ショット、POV 視点、ドローン ショットなど、ユーザーによって促された特定のカメラ コントロールの理解と実行にまで及び、生成されたコンテンツに映画のような品質のレイヤーが追加されます。この機能は、大規模な物理リソースを必要とせずに従来の映画制作の限界を押し広げたいと考えているクリエイターにとって特に魅力的です。

Google および Alphabet の CEO、Sundar Pichai 氏が本日初めに X 投稿で発表し、Veo 2 で作成された非常に印象的なハイライト リールを共有しました。

リアリズムと動き

Veo 2 の最も注目すべき機能の 1 つは、リアルな動きを持つビデオを生成できることです。これには、AI モデルが忠実にキャプチャすることがしばしば困難であった人間の表情や動きの正確な描写が含まれます。

Veo 2 の物理学への理解により、ダイナミック シーケンスのリアリズムが強化され、ビデオが視覚的に魅力的であるだけでなく、シーン内でオブジェクトやキャラクターがどのように相互作用するかという点においても信頼できるものになります。

ユーザーのアクセシビリティと影響

当初、Veo 2 は Google の VideoFX プラットフォームの一部として順番待ちリストに登録されており、このような強力なテクノロジーを利用できるようにするための Google の慎重かつ進歩的なアプローチを示しています。

この制御されたリリースにより、Google は初期ユーザーからのフィードバックを収集し、実際のアプリケーション シナリオに基づいてモデルを改良できるようになります。クリエイター、教育者、企業にとっての影響は大きく、コストと技術的な障壁の両方を軽減してビデオ制作を民主化できるツールが提供されます。

https://labs.google/experiments

結論

Google DeepMind の Veo 2 は、AI 主導のビデオ制作における重要なマイルストーンを表します。視覚的なストーリーテリング要素の制御を強化することで、ユーザーは単なるテキストや画像のプロンプトから映画のようなビジュアルを思い出せるようになります。

このテクノロジーがさまざまなプラットフォームやツールにさらに統合されるにつれて、革新的なコンテンツ作成が急増し、デジタル時代におけるストーリーの伝え方を再定義する可能性があると予想されます。

ただし、大きな力には大きな責任が伴い、Veo 2 の可能性をより大きな利益のために活用するには、倫理的な AI の使用に関する継続的な対話が重要になります。


#GoogleOpenAIのSoraを破壊するテキストトゥビデオのVeo #2を発表

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。