1751046697
2025-06-27 17:36:00
Smirkdingo/Getty Images
VEO 3、Googleの新しいビデオ生成モデルは、インターネット全体で波を展開しています。 発表 木曜日。
このツールは当初、Gemini Ultraの加入者と、最新のI/Oで明らかにされたGoogleのAI駆動型映画製作プラットフォームであるFlowのみが利用できました。木曜日の時点で、すべてのGoogleクラウドの顧客とパートナーからのパブリックプレビューとしてアクセスできます。 頂点AIメディアスタジオ。
また:2025年の最高のAI画像ジェネレーター:Gemini、ChatGpt、Midjourneyなど
Googleの年次開発者会議であるI/Oで先月発表されたVEO 3は、この分野で長年の技術的課題である同期オーディオでビデオを生成できます。たとえば、忙しい地下鉄の車内でビデオセットを生成するようシステムに促すと想像してください。 VEO 3は、AIに生成された周囲の背景ノイズを備えたビデオを作成して、リアリズムの感覚を増します。 Googleによると、人間の声の音声を生成するように促すこともできます。
このモデルは、水の流動的なダイナミクスや影の動きなど、現実世界の物理学を現実的にシミュレートすることも専門としており、映画製作者にとって潜在的に価値のあるツールになり、使用可能なAIをクリエイティブ産業にもたらすというGoogleのより広い使命を促進します。
ユーザーは、自然言語のテキストプロンプトを介してVEO 3にビデオを作成し、微妙な創造的な詳細を変更するための指示を微調整できます。 ブログ投稿 木曜日。
ユースケース – および欠点
Googleはブログの投稿で、さまざまな企業がVEO 3を積極的に実験して、ソーシャルメディア広告や製品デモなど、トレーニングビデオなどの内部資料を含む顧客向けコンテンツを生成していることを指摘しました。あるCEOは、それを「2023年にGen AIが初めて主流に侵入して以来、広告において実質的に有用なAIで唯一の最大の飛躍である」と説明しました。
また:AIがノックするとき、オープンソースのスキルはあなたのキャリアを救うことができます
Googleやその他の大手AI開発者は、自然言語のプロンプトからビデオを生成するように設計されたツールに多額の投資を行っており、これが生成AIの主要な実践的なケースになると賭けています。たとえば、AI Avatar Company Synthesiaは、CEOのようなユーザーに肖像を複製して会社のビデオアドレスを作成できるようにすることで、エンタープライズコンテンツをより速く、より少ないリソースにする方法としてテクノロジーを提供しています。
毎日あなたの受信トレイで朝のトップストーリーを入手してください Tech Todayニュースレター。
創造的な専門家の間の反応は混ざり合っています。一部の人は、AI支援の映画製作の将来の前向きな可能性を見ています。称賛された監督のダレン・アロノフスキーは、1つのために創造的なものを形成しました パートナーシップ Google DeepMindで。同様の 取引 ライオンズゲートとAIのスタートアップ滑走路の間で打たれました。
しかし、他の人々は、クリエイティブ産業全体でAIが生成したビデオの侵入の増加に批判的でした。 a ビデオ広告 たとえば、昨年OpenaiのSORAを使用して作成されたToys r ‘Usでは、広範なオンラインのrid笑を受け取りました。娯楽労働者の組合はそうです 彼らの仕事を保護するために整理する 技術が急速に進化するにつれて。
これにより、ハイテク企業がマーケティング担当者向けの新しいビデオ生成ツールの構築とリリースを妨げていません。今月初め、Amazon Adsは、ビデオ生成ツールの米国で一般的な発売を発表しました。メタは、広告制作プロセスのすべてのステップを自動化することを目指していると伝えられていると伝えられています。
主要な技術的課題
VEO 3は、AIに生成されたビデオとオーディオを同期できる主要なハイテク開発者の最初のモデルの1つです。メタ 映画gen、10月にリリースされたのは別です。 RunwayのGen-3 Alphaのような他のいくつかのツールには、ポストプロダクションプロセスでAIに生成されたオーディオをビデオに可能にする機能が付属していますが、2つの同時生成にはGoogleのような主要な力の計算とリソースが必要です。
また:私は5つのAIボットでチャットしました – これらは最高の会話をしました
同期されたビデオとオーディオを生成できるAIモデルの構築は、厄介な技術的課題であり、AI業界全体で活発な研究分野です。 AIに生成されたビデオとAIに生成されたオーディオの両方は、明確な技術的課題であり、それらを融合させると、まったく新しい複雑さが導入されます。これがVeo 3のデモです。
1つには、ビデオは一連のまだフレームですが、オーディオは連続的な波です。したがって、2つの同期には、これら2つのモダリティで動作できるモデルが必要であり、それらが動作する非常に異なるタイムスケールを説明します。
また: Google Flowは映画製作者向けの新しいAIビデオジェネレーターです – 今日それを試す方法
ビデオとサウンドを融合するAIモデルは、材料、距離、速度などの変数を動的に説明できる必要があります。時速100マイルで運転する車は、時速10マイルで移動するものとは大きく異なります。石畳の上を歩く馬は、草の上を歩いているものとは異なります。
#GoogleのVEO3AIビデオジェネレーターは誰でも利用できるようになりました #これを試してみる方法は次のとおりです