日本語版
最新ニュース
科学&テクノロジー

モナリザのラップ? 新しい Microsoft AI が写真から顔をアニメーション化します

I Ryu/Visual China Group/Getty Images 2023年3月19日、ワシントン州シアトルの本社でマイクロソフトの看板が見られる。 ニューヨーク > — マイクロソフトの新しい人工知能技術のおかげで、モナリザは微笑む以上のことができるようになりました。 先週、Microsoftの研究者らは、顔の静止画像と話している人の音声クリップを撮影し、その人が話しているリアルなビデオを自動的に作成できる、開発した新しいAIモデルについて詳しく説明した。 このビデオは、フォトリアリスティックな顔だけでなく、漫画やアートワークからも作成でき、説得力のあるリップシンクと自然な顔と頭の動きを備えています。 あるデモビデオでは、研究者らがモナリザをアニメーション化して俳優アン・ハサウェイのコメディーなラップを朗読する様子を示した。 AI モデルからの出力。 VASA-1、両方とも面白いですが、そのリアルさは少し不快です。 マイクロソフトは、この技術は教育や「コミュニケーションに困難を抱える個人のアクセシビリティの向上」に使用でき、あるいは人間の仮想コンパニオンを作成する可能性もあると述べた。 しかし、このツールが悪用され、実際の人間になりすますために使用される可能性があることも容易にわかります。 これは Microsoft を超えた懸念です。AI によって生成された説得力のある画像、ビデオ、オーディオを作成するツールがさらに登場するにつれて、 専門家は心配する それらの誤用は新たな形の誤った情報につながる可能性があるということです。 また、この技術が映画から広告までクリエイティブ産業をさらに混乱させる可能性があると懸念する人もいる。 Microsoftは今のところ、VASA-1モデルをすぐに一般公開する予定はないと述べた。 この動きは、Microsoft パートナーである OpenAI が次のような懸念に対処しているのと似ています。 AI が生成したビデオ ツールSora:OpenAIは2月にSoraをからかったが、これまでのところテスト目的で一部の専門ユーザーとサイバーセキュリティ教授にのみ利用可能にしている。 Microsoftの研究者らはブログ投稿で、「実在の人物に関する誤解を招くコンテンツや有害なコンテンツを作成するいかなる行為にも反対する」と述べた。 しかし、同社は「技術が適切な規制に従って責任を持って使用されると確信するまで」製品を「公開する予定はない」と付け加えた。 マイクロソフトの新しいAIモデルは、話している人の顔の多数のビデオでトレーニングされており、「特に唇の動き、(唇以外の)表情、視線、瞬きなど」を含む自然な顔と頭の動きを認識するように設計されていると研究者らは述べた。 VASA-1 が静止写真をアニメーション化すると、より本物に近いビデオが得られます。…

モナリザのラップ? 新しい Microsoft AI が写真から顔をアニメーション化します

1713697713
2024-04-21 07:00:00

I Ryu/Visual China Group/Getty Images

2023年3月19日、ワシントン州シアトルの本社でマイクロソフトの看板が見られる。


ニューヨーク
>

マイクロソフトの新しい人工知能技術のおかげで、モナリザは微笑む以上のことができるようになりました。

先週、Microsoftの研究者らは、顔の静止画像と話している人の音声クリップを撮影し、その人が話しているリアルなビデオを自動的に作成できる、開発した新しいAIモデルについて詳しく説明した。 このビデオは、フォトリアリスティックな顔だけでなく、漫画やアートワークからも作成でき、説得力のあるリップシンクと自然な顔と頭の動きを備えています。

あるデモビデオでは、研究者らがモナリザをアニメーション化して俳優アン・ハサウェイのコメディーなラップを朗読する様子を示した。

AI モデルからの出力。 VASA-1、両方とも面白いですが、そのリアルさは少し不快です。 マイクロソフトは、この技術は教育や「コミュニケーションに困難を抱える個人のアクセシビリティの向上」に使用でき、あるいは人間の仮想コンパニオンを作成する可能性もあると述べた。 しかし、このツールが悪用され、実際の人間になりすますために使用される可能性があることも容易にわかります。

これは Microsoft を超えた懸念です。AI によって生成された説得力のある画像、ビデオ、オーディオを作成するツールがさらに登場するにつれて、 専門家は心配する それらの誤用は新たな形の誤った情報につながる可能性があるということです。 また、この技術が映画から広告までクリエイティブ産業をさらに混乱させる可能性があると懸念する人もいる。

Microsoftは今のところ、VASA-1モデルをすぐに一般公開する予定はないと述べた。 この動きは、Microsoft パートナーである OpenAI が次のような懸念に対処しているのと似ています。 AI が生成したビデオ ツールSora:OpenAIは2月にSoraをからかったが、これまでのところテスト目的で一部の専門ユーザーとサイバーセキュリティ教授にのみ利用可能にしている。

Microsoftの研究者らはブログ投稿で、「実在の人物に関する誤解を招くコンテンツや有害なコンテンツを作成するいかなる行為にも反対する」と述べた。 しかし、同社は「技術が適切な規制に従って責任を持って使用されると確信するまで」製品を「公開する予定はない」と付け加えた。

マイクロソフトの新しいAIモデルは、話している人の顔の多数のビデオでトレーニングされており、「特に唇の動き、(唇以外の)表情、視線、瞬きなど」を含む自然な顔と頭の動きを認識するように設計されていると研究者らは述べた。 VASA-1 が静止写真をアニメーション化すると、より本物に近いビデオが得られます。

たとえば、ビデオゲームをプレイしていると思われる誰かが興奮したように聞こえるクリップをセットしたデモビデオでは、話している顔は眉間にしわを寄せ、唇をすぼめています。

AI ツールは、被写体が特定の方向を向いている、または特定の感情を表現しているビデオを生成するように指示することもできます。

よく見ると、まれなまばたきや誇張された眉の動きなど、ビデオが機械で生成された痕跡がまだ残っています。 しかしマイクロソフトは、自社のモデルは他の同様のツールを「大幅に上回り」、「人間の会話行動をエミュレートする実物そっくりのアバターとのリアルタイムの関わりへの道を開く」と信じていると述べた。

#モナリザのラップ #新しい #Microsoft #が写真から顔をアニメーション化します

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。