1720504896
2024-07-09 05:09:00
【上海2024年7月9日PR Newswire】7月4日、2024年世界人工知能大会(WAIC 2024)が正式に開幕した。今年のテーマは「善とすべての人々のためのAIの統治」で、コアテクノロジー、インテリジェント端末、アプリケーションエンパワーメントの3つの主要セクションに重点が置かれた。
AI技術を取り入れた大手ソーシャルプラットフォームとして、Soul Appは展示会への参加を招待され、「デジタルツイン」「ウェアウルフ覚醒」「EchoVerse」など、AI分野におけるいくつかの新機能を展示しました。
Soul AppはAI分野での新機能をいくつか披露した。
マルチモーダルインタラクション機能を示す3つの新機能が発表されました
WAIC 2024イベント会場で、Soulは「Human Touch、Digital Heart」をテーマにブースを出展し、特に「AIGC + Social」の深遠な統合を探求するSoulの最新の取り組みである「Digital Twin」、「Werewolf Awakening」、「EchoVerse」という3つの新機能を実演しました。
その中で、「デジタルツイン」は、ユーザーが効率的に交流するための仮想デジタルヒューマンを作成することを支援することに専念しています。ユーザーは、ソウルのパブリックドメインシーンでのチャット記録や投稿コンテンツに基づいて、プラットフォームにデジタルツインのイメージと特性を設定する権限を与えることができます。ペルソナ、イメージ、音声などの豊富な次元で、デジタルツインは実際の人物を複製する効果を最大限に実現できます。
Soul プラットフォームは、興味に基づく交流を堅持しており、実際の人間のプロフィール写真の利用をサポートしていません。ユーザーは、デジタル空間での交流のために、アバター システムを通じて仮想イメージを作成します。現在、プライベート チャット支援機能を備えた「デジタル ツイン」のリリースにより、ユーザーはより理想的な「もう一人の自分」を作成できるだけでなく、よりパーソナライズされた多様なインテリジェントな返信推奨が可能になり、ユーザーが交流を始めるきっかけを作り、ペルソナ構築と認知的意思決定を支援する際のソーシャル コミュニケーションの効率が向上します。
また、ゲームインタラクションシナリオ「Werewolf Awakening」にAIエンティティを導入することで、大規模モデルのマルチモーダルインタラクション機能が顕著に示されます。このシナリオでは、ユーザーはAIと実際の人物の任意の組み合わせモードを選択してインタラクションを開始し、自律的な推論、発話、および「変装」機能を備えたAIエンティティと実際のゲーム対決に参加できます。「AIゲームコンパニオン」は、プレイヤーが比較的敷居が高く複雑な人狼ゲームのゲームプレイに素早く適応し、簡単にコミュニケーションを開始し、より没入感のあるリアルタイムのインタラクションで楽しい体験を得るのにも役立ちます。
Soulは、AI機能を現場のシナリオに統合すると同時に、独自の新機能「EchoVerse」もリリースしました。この機能は、ユーザーが仮想キャラクターと没入型のリアルタイムコミュニケーションを行えるAIソーシャルプラットフォームとして位置付けられており、好みに応じてキャラクターのペルソナをカスタマイズして、さまざまな会話スタイルを実現できます。キャラクターのイメージは、テキストの説明または希望する写真をアップロードすることで生成できます。このプラットフォームは複数の基本音色を提供し、ユーザーは独自にキャラクターの独自の声を作成して融合し、マルチモーダルインタラクションを実現できます。
「シナジーモデルとアプリケーションの相互作用」の実践、社会の改善から人間とコンピュータの相互作用の新しい経験まで
実際、Soulは比較的早くからソーシャル分野へのAIの応用を検討し始めたプラットフォームとして、2016年の立ち上げ以来、AIをめぐる基盤技術やアプリケーションの実装の探求に着手してきました。
例えば、ユーザーステーションにフルシーンポートレートに基づくインテリジェントな推奨エンジン「Ling Xi」を導入することで、プラットフォームは分散型のメカニズムでユーザーが同じ興味を持つ人を見つけるのを支援し、複数の関係の構築と即時の感情的フィードバックを同様に実現し、ユーザーエクスペリエンスを効果的に向上させます。さらに、プラットフォームのNAWAエンジンにより、ユーザーは没入型のインタラクションのためにパーソナライズされたアバターとシーンを作成できます。
Soulは2020年にAIGCの体系的な研究開発作業を開始し、音声生成、音楽生成、音声アニメーションなど、インテリジェントな対話、画像生成、音声技術の最先端の機能を蓄積してきました。2023年には、プロンプト駆動、条件付き制御可能な生成、コンテキスト理解、マルチモーダル理解などの機能を備え、感情的で親しみやすいインタラクションを実現できる自社開発の大規模言語モデルSoulXを発表しました。
2024年にSoulの音声生成大型モデルが発売され、自社開発の音声大型モデルが正式にアップグレードされました。現段階で、Soulの音声大型モデルは、音声生成大型モデル、音声認識大型モデル、音声対話大型モデル、音楽生成大型モデルを包含し、リアルな音色生成、音声DIY、多言語切り替え、多感情の実在人物のようなリアルタイム対話などの機能をサポートできます。
現在、Soul の実現したマルチモーダルインタラクション機能は、Soul の「AI Godan」、Werewolf Awakening、Digital Twin、EchoVerse などの特定のアプリケーション シナリオに統合されており、インタラクションの効率、インタラクションの品質、インタラクションの体験、インタラクション オブジェクトなどの面での強化と拡張がさらに実現されています。
「ユーザーがAIと継続的に会話ややり取りをしたいという意欲は、プラットフォームが提供する体験に対するユーザーの認識をすでに証明しています。これはまた、Soulが「シナジーモデルとアプリケーションの相互作用」の方向性にこだわり続けていることの持続性を示しています」とSoul AppのCTO、タオ・ミン氏は述べた。
AIは釘に適したハンマーを見つけるようなものだとタオ・ミン氏は言う。「Soulは中国の若者の間で最も人気のあるインターネットプラットフォームの1つです。自然な応用シーンであり、トラフィックの入り口です。私たちの利点は、シーンのユーザーの実際のニーズを特定できることと、大規模なモデルの適用によりユーザーからのフィードバックをすぐに得られることです。」
ソース:ソウルアプリ
#Soul #App #の #つの新機能が #WAIC #で発表されモデルとアプリケーションの相乗的な相互作用という製品哲学を体現