日本語版
最新ニュース
エンタメ

Podcastleは、450票以上の票でAIベースのテキストからスピーチモデルを開始します

Munich(It Boltwise) - ポッドキャストプラットフォームPodcastleは、450を超えるさまざまな声を提供する新しいAIベースのテキストからスピーチモデルを導入しました。この開発は、AIテクノロジーの重要なステップを告げ、企業がコンテンツをより効率的かつ安価にすることを可能にします。ポッドキャストの録音とアレンジメントのプラットフォームであるPodcastleは、最近、AsyncFlow v1.0と呼ばれる独自のAIモデルを立ち上げました。同社は、AIベースのテキストからスピーチテクノロジーの成長競争において、この紹介を位置付けています。開発者には、モデルをアプリケーションに直接統合できるAPIも提供されます。新しいモデルのおかげで、Podcastleはテキストを物語的に実装できる450を超えるAI声を提供できます。同社は、このテクノロジーは、トレーニングと推論コストが低く抑えるように開発されていることを強調しています。これは、他のプロバイダーよりも競争上の優位性を表しています。このステップにより、Podcastleは、ElevenLabs、Speechify、Wellsaidなどの多くのスタートアップの一部であり、テキストをAIが話したオーディオクリップに変換するテクノロジーを開発しました。このテクノロジーは、マーケティング、広告、コンテンツの作成、教育、企業トレーニングなどの分野で使用されます。Podcastleの創設者であるArto Yeritsyanは、同社は常にテキストからスピーチモデルの開発を望んでいたが、トレーニングとデータの要件の高いコストが課題であると述べました。「基礎以来、堅牢なテキストからスピーチモデルを開発したかったのです。最近の大規模な音声モデルの進捗状況のおかげで、昨年ブレークスルーを行うことができました。これにより、大量のデータを必要とせずに高品質の言語モデルを開発することができました」とYeritsyan氏は述べています。同社はまた、昨年1億350万ドルのシリーズAファイナンスによる努力においてサポートされました。Yeritsyanは、Podcastleはテキストからスピーチへの変換で500ドルで約40ドルを計算し、ElevenLabsは同じパフォーマンスで99ドルを要求します。ポッドキャッスルの音声クローニング関数も改善され、トレーニングプロセスが加速されます。過去には、約70の異なる文章を読む必要がありましたが、今では数秒の録音で音声をクローンするのに十分です。新しいプロセスでは、昨年発行されたポッドキャッスルのマジックダストAIも使用しています。私たちのテストでは、新しいプロセスで作成された声は、私たちのトーンを模倣したにもかかわらず、少しロボットに聞こえました。同社は、時間の経過とともに機能を改善すると説明しました。また、さまざまな音声サンプルをトレーニングして、さまざまな結果を達成することもできます。Podcastleは、コストに加えて、新たに設計されたWebサイトでのオーディオ、ビデオ、ポッドキャスト、AIサポートされたストーリーのツールの提供も競争よりも利点であると説明しました。 Yeritsyan氏は、ユーザーの大半はPodcastleを使用してオーディオコンテンツを処理するだけでなく、重要なビデオも取得していると述べました。 Ki-Morning Newsletter「Der Ki News Espresso」と最終日の最高のAIニュースを備えた広告なしで無料で無料で無料で入力してください。 Podcastleは、450票以上のAIベースのテキストからスピーチモデルを開始します(写真:Dall-e、boltwise) 編集チームへの追加と情報de-infoへの電子メール[at]それはboltwise.de。 AI生成されたニュースやコンテンツが発生した場合、AIの幻覚をめったに除外できないため、メールでの誤った情報と誤報を連絡してお知らせください。メールの記事の見出しに名前を付けることを忘れないでください: 「Podcastleは、450票以上のAIベースのテキストからスピーチモデルを開始します」。 #Podcastleは450票以上の票でAIベースのテキストからスピーチモデルを開始します

Podcastleは、450票以上の票でAIベースのテキストからスピーチモデルを開始します

Munich(It Boltwise) – ポッドキャストプラットフォームPodcastleは、450を超えるさまざまな声を提供する新しいAIベースのテキストからスピーチモデルを導入しました。この開発は、AIテクノロジーの重要なステップを告げ、企業がコンテンツをより効率的かつ安価にすることを可能にします。

ポッドキャストの録音とアレンジメントのプラットフォームであるPodcastleは、最近、AsyncFlow v1.0と呼ばれる独自のAIモデルを立ち上げました。同社は、AIベースのテキストからスピーチテクノロジーの成長競争において、この紹介を位置付けています。開発者には、モデルをアプリケーションに直接統合できるAPIも提供されます。

新しいモデルのおかげで、Podcastleはテキストを物語的に実装できる450を超えるAI声を提供できます。同社は、このテクノロジーは、トレーニングと推論コストが低く抑えるように開発されていることを強調しています。これは、他のプロバイダーよりも競争上の優位性を表しています。

このステップにより、Podcastleは、ElevenLabs、Speechify、Wellsaidなどの多くのスタートアップの一部であり、テキストをAIが話したオーディオクリップに変換するテクノロジーを開発しました。このテクノロジーは、マーケティング、広告、コンテンツの作成、教育、企業トレーニングなどの分野で使用されます。

Podcastleの創設者であるArto Yeritsyanは、同社は常にテキストからスピーチモデルの開発を望んでいたが、トレーニングとデータの要件の高いコストが課題であると述べました。

「基礎以来、堅牢なテキストからスピーチモデルを開発したかったのです。最近の大規模な音声モデルの進捗状況のおかげで、昨年ブレークスルーを行うことができました。これにより、大量のデータを必要とせずに高品質の言語モデルを開発することができました」とYeritsyan氏は述べています。

同社はまた、昨年1億350万ドルのシリーズAファイナンスによる努力においてサポートされました。

Yeritsyanは、Podcastleはテキストからスピーチへの変換で500ドルで約40ドルを計算し、ElevenLabsは同じパフォーマンスで99ドルを要求します。

ポッドキャッスルの音声クローニング関数も改善され、トレーニングプロセスが加速されます。過去には、約70の異なる文章を読む必要がありましたが、今では数秒の録音で音声をクローンするのに十分です。新しいプロセスでは、昨年発行されたポッドキャッスルのマジックダストAIも使用しています。

私たちのテストでは、新しいプロセスで作成された声は、私たちのトーンを模倣したにもかかわらず、少しロボットに聞こえました。同社は、時間の経過とともに機能を改善すると説明しました。また、さまざまな音声サンプルをトレーニングして、さまざまな結果を達成することもできます。

Podcastleは、コストに加えて、新たに設計されたWebサイトでのオーディオ、ビデオ、ポッドキャスト、AIサポートされたストーリーのツールの提供も競争よりも利点であると説明しました。 Yeritsyan氏は、ユーザーの大半はPodcastleを使用してオーディオコンテンツを処理するだけでなく、重要なビデオも取得していると述べました。

Ki-Morning Newsletter「Der Ki News Espresso」と最終日の最高のAIニュースを備えた広告なしで無料で無料で無料で入力してください。

Podcastleは、450票以上の票でAIベースのテキストからスピーチモデルを開始します
Podcastleは、450票以上のAIベースのテキストからスピーチモデルを開始します(写真:Dall-e、boltwise)

編集チームへの追加と情報de-infoへの電子メール[at]それはboltwise.de。 AI生成されたニュースやコンテンツが発生した場合、AIの幻覚をめったに除外できないため、メールでの誤った情報と誤報を連絡してお知らせください。メールの記事の見出しに名前を付けることを忘れないでください: 「Podcastleは、450票以上のAIベースのテキストからスピーチモデルを開始します」

#Podcastleは450票以上の票でAIベースのテキストからスピーチモデルを開始します

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。