1708288825
2024-02-15 23:18:15
それがまだ起こっていないとき ChatGPT の魅力 OpenAI は、生成人工知能言語モデルを備えた、Sora と呼ばれる驚くべき革新的なビデオ作成ツールを導入しました。 これを使用すると、画面上で見たいものの説明を入力するだけで、によって作成されたクリップが表示されます。 人工知能。 他の人よりも優れた人もいれば、現実とは異なるビデオゲームのスタイルを持っている人もいますが、それらはすべて驚くべきものです。
OpenAI CEOのサム・アルトマン氏が立ち上げを発表 ソーシャルネットワーク上で、あっという間に新しい作品が溢れかえりました。 現実的なビデオ、未来的なビデオ、クレイジーなビデオ、漫画のビデオなど…ビデオには、生成人工知能によって作成されたあらゆる種類の自動作品が含まれています。 Sora はビデオ全体を一度に作成したり、生成されたビデオを拡大して長くしたりすることができます。
テスト中 アルトマンが示した そしてあなたの会社では、複数のキャラクター、特定の種類の動き、主題と背景の正確な詳細が含まれる複雑なシーンを目にすることになります。 OpenAIによると、このモデルはユーザーがリクエストで何を要求したかだけでなく、それらのものが物理世界にどのように存在するのかも理解するという。 このモデルは言語を深く理解しており、手がかりを正確に解釈し、生き生きとした感情を表現する魅力的なキャラクターを生成できると同社は説明しています。
「こちらがビデオ生成モデルのソラです」 アルトマンはこう書いている。 「私たちは限られた数のクリエイターにアクセスを提供しています」と彼は付け加え、その後、ウェブサイトですでに提供しているサンプルに加えて、新しいビデオを作成するための提案をフォロワーに求めた。
手順は多かれ少なかれ詳細である場合があります。 OpenAI が提供する例の 1 つは、次の説明に応答します。「エレガントな女性が、暖かく明るいネオンと活気のある都市の看板でいっぱいの東京の通りを歩いています。 彼女は黒い革のジャケット、赤い長いドレス、黒いブーツ、黒いバッグを着ています。 彼女はサングラスと赤い口紅をつけています。 彼女は自信を持って不注意に歩いています。 道路は濡れていて反射しているため、色付きの光の鏡効果が生じています。 多くの歩行者が歩き回っています。 そしてその結果は驚くべきものです (その上)。
別の注記:「赤い毛糸のオートバイヘルメットをかぶった30歳の宇宙飛行士の冒険を描いた映画の予告編、青い空、塩の砂漠、映画のようなスタイル、35mmフィルムで撮影、明るい色」(下)。
このモデルは、テキストの指示のみからビデオを生成できることに加えて、既存の静止画像を取得してそこからビデオを生成し、画像のコンテンツを細部まで正確にアニメーション化することができます。 詳細。 モデルは既存のビデオを取得して、ズームインしたり、欠落しているフレームを埋めることもできます。
内容やスタイルをリクエストしたり、あらゆる種類の指示を与えることができます。 アルトマン氏はツイート投稿者からリクエストされた新しい動画を公開しており、結果がすぐに現れることを証明している。 Sora は、キャラクターやビジュアル スタイルを正確に維持しながら、生成された 1 つのビデオ内で複数のショットを作成することもできます。
「私たちは、人々が現実世界でのインタラクションを必要とする問題を解決するのに役立つモデルをトレーニングすることを目的として、動いている物理世界を理解してシミュレーションできるように AI を教えています。」 新しいテキストからビデオへの変換ツールを提示する際の OpenAI について説明します。 「Sora は、視覚的な品質とユーザーの指示への忠実さを維持しながら、最長 1 分のビデオを生成できます。」と彼は付け加えました。
今のところ、このツールはいわゆるレッドチームが利用できるようになっている。 これらのチームのメンバーは、あたかも会社の敵であるかのように、製品やサービスに疑問を抱き、限界まで押し上げ、テストし、欠点を見つけようとします。 ここで彼らは、潜在的な損害やリスクについて重要な領域を評価するという特別な使命を担っています。 その中には、誤った情報、憎悪に満ちたコンテンツ、偏見などの分野の専門家もいます。
Open AI はまた、さまざまなビジュアル アーティスト、デザイナー、映画製作者にアクセスを提供し、モデルを改善してクリエイティブな専門家にとってより役立つものにする方法についてフィードバックを提供します。
「私たちは、OpenAI 以外の人々と協力してフィードバックを得るために、また、一般の人々に今後の AI 機能についてのアイデアを提供するために、研究の進捗状況を早期に共有しています」と同社は説明しています。 ああ。
研磨すべき欠陥
人工知能企業自体も、Sora にはまだ明らかな欠陥がいくつかあることを認識しています。 複雑なシーンの物理を正確にシミュレートするのに苦労したり、原因と結果の特定のケースを理解できない場合があります。 彼は、人はクッキーを一口かじることはできても、そのクッキーには噛み跡がつかない可能性があることを例に挙げています。
また、モデルは、左と右を混同するなど、キューの空間的詳細を混乱させる可能性があり、特定のカメラ パスをたどるなど、時間の経過とともに発生するイベントの正確な記述に問題が生じる可能性があります。
OpenAIはツールを一般公開する前に、いくつかの予防措置を講じることを約束している。 その中には、レッドチームの指示が考慮されています。 さらに、Sora によってビデオがいつ生成されたかを知ることができる検出機能を備えた、欺瞞的なコンテンツの検出に役立つツールも作成しています。 また、生成されたすべてのビデオのフレームをレビューして、ユーザーに表示する前に使用ポリシーに準拠していることを確認するために使用される強力な画像分類器も開発しました。
さらに、DALL-E 3 を使用する製品用に作成したセキュリティ メソッドを再利用します。たとえば、テキスト分類子は、極端な暴力や性的コンテンツを要求するものなど、使用ポリシーに違反するテキスト入力要求をチェックして拒否します。 、憎しみを煽る画像、有名人の画像、または第三者の知的財産。
「私たちは世界中の政策立案者、教育者、アーティストに連絡を取り、彼らの懸念を聞き、この新しいテクノロジーの前向きな使用例を特定します。 広範な調査とテストにもかかわらず、人々が当社のテクノロジーを有益に使用するすべての方法や悪用するすべての方法を予測することはできません。 そのため、実世界の使用から学ぶことが、時間の経過とともにより安全性が高まる AI システムを作成して立ち上げるための基本的な要素であると私たちは信じています」と OpenAI は結論づけています。
フォローできます EL PAÍS テクノロジー で フェイスブック y バツ または、ここからサインアップして私たちのメッセージを受け取りましょう ニュースレターセマナル。
#OpenAI #が人工知能を備えた革新的なビデオ #ツール #Sora #を発表 #テクノロジー