日本語版
最新ニュース
世界

Character.aiは、実際のビデオ制作のためにTalkingMachinesを導入しました

Character.ai生産的なビデオに関する彼の研究のいくつか 共有 そして、彼はTalkingCachinesと呼ばれる新しい機関の拡散モデルを開発しました。これは、画像とサウンド信号から人工知能キャラクターの実際の音声指向ビデオを生成できます。これにより、会社はファセティタイムと人工知能キャラクターの視覚的な相互作用にアプローチします。 このモデルはまだ研究プロセスにあることを強調しましょう。調査記事とビデオデモはありますが、Character.AIアプリケーションでそれらを使用することはまだ不可能です。これがCharacter.AIアプリケーションに反映されている場合、ユーザーは、人工知能を使用したより没入型の役割 - ゲームに参加し、インタラクティブなストーリーテリングに参加し、ビジュアルワールドを構築することを許可します。 新しいTalkingCachinesモデルは、ランダムノイズから詳細な画像を作成し、完璧になるまで画像を癒すことができるアーティストであるDiffusion Transformer(DIÉT)テクノロジーに基づいて構築されました。キャラクターがそれを信じられないほど速く動作させるために何をするか、したがって、それを本当のタイムのように感じさせます。 そのブレークスルーを実現するために、TalkingCachinesは、ストリーミングマッチング拡散、健全な相互注意、まばらな因果関係、非対称蒸留などのいくつかの基本的な手法を使用します。 フローマッチングされた拡散は、薄い表情からより劇的なジェスチャーまで、多くの動きについて訓練されています。これは、人工知能のキャラクターがより自然に動くことを保証するのに役立ちます。エキサイティングな作品は、人工知能が言葉を聞くだけでなく、音のリズム、一時停止、イントネーションを理解し、それらを敏感な口の動き、頭の揺れ、目の瞬きに変換できるようにするための音指向のクロスアテナテンションによって提供されます。まばらな因果関係により、Character.AIは、ビデオのフレームをはるかにコスト効果の高い方法で処理でき、ビデオを非対称蒸留でリアルタイムで作成できます。 Charition.aiは、この研究のブレークスルーは顔のアニメーションだけではないと主張しています。彼は、これがリアルタイムでやり取りできるインタラクティブな視覚労働者の人工知能キャラクターへの一歩であると言います。このモデルは、光ゲラ科医、アニメ、3Dアバターなど、幅広いスタイルをサポートし、自然なリスニング段階とスピーキング段階で流れることができます。 Chariture.aiはまだリリースされている場合、まだ研究段階にあります。それを達成した最初の企業の1つになります。このアドレスでモデルの例にアクセスできます。 #Character.aiは実際のビデオ制作のためにTalkingMachinesを導入しました

Character.aiは、実際のビデオ制作のためにTalkingMachinesを導入しました

1751685724
2025-07-04 17:00:00

Character.ai生産的なビデオに関する彼の研究のいくつか 共有 そして、彼はTalkingCachinesと呼ばれる新しい機関の拡散モデルを開発しました。これは、画像とサウンド信号から人工知能キャラクターの実際の音声指向ビデオを生成できます。これにより、会社はファセティタイムと人工知能キャラクターの視覚的な相互作用にアプローチします。

このモデルはまだ研究プロセスにあることを強調しましょう。調査記事とビデオデモはありますが、Character.AIアプリケーションでそれらを使用することはまだ不可能です。これがCharacter.AIアプリケーションに反映されている場合、ユーザーは、人工知能を使用したより没入型の役割 – ゲームに参加し、インタラクティブなストーリーテリングに参加し、ビジュアルワールドを構築することを許可します。

新しいTalkingCachinesモデルは、ランダムノイズから詳細な画像を作成し、完璧になるまで画像を癒すことができるアーティストであるDiffusion Transformer(DIÉT)テクノロジーに基づいて構築されました。キャラクターがそれを信じられないほど速く動作させるために何をするか、したがって、それを本当のタイムのように感じさせます。

そのブレークスルーを実現するために、TalkingCachinesは、ストリーミングマッチング拡散、健全な相互注意、まばらな因果関係、非対称蒸留などのいくつかの基本的な手法を使用します。

フローマッチングされた拡散は、薄い表情からより劇的なジェスチャーまで、多くの動きについて訓練されています。これは、人工知能のキャラクターがより自然に動くことを保証するのに役立ちます。エキサイティングな作品は、人工知能が言葉を聞くだけでなく、音のリズム、一時停止、イントネーションを理解し、それらを敏感な口の動き、頭の揺れ、目の瞬きに変換できるようにするための音指向のクロスアテナテンションによって提供されます。まばらな因果関係により、Character.AIは、ビデオのフレームをはるかにコスト効果の高い方法で処理でき、ビデオを非対称蒸留でリアルタイムで作成できます。

Charition.aiは、この研究のブレークスルーは顔のアニメーションだけではないと主張しています。彼は、これがリアルタイムでやり取りできるインタラクティブな視覚労働者の人工知能キャラクターへの一歩であると言います。このモデルは、光ゲラ科医、アニメ、3Dアバターなど、幅広いスタイルをサポートし、自然なリスニング段階とスピーキング段階で流れることができます。

Chariture.aiはまだリリースされている場合、まだ研究段階にあります。それを達成した最初の企業の1つになります。このアドレスでモデルの例にアクセスできます。

#Character.aiは実際のビデオ制作のためにTalkingMachinesを導入しました

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。