1747021900
2025-05-12 03:20:00
すべてが自然に聞こえます。辞書は良好で、言葉はリズムのために絡み合って液体句を形成し、テキストを読むときに行う一時停止があります。音声のイントネーションと速度も人間のようです。しかし、彼らはそうではありません:私たちはオーディオブックを聴いています 合成声でナレーションされています。誰もそれを記録するために研究に座っていません。それは、すでに彼らの収入が減少しているのを見ているプロのナレーターを心配しています。しかし、業界は 彼は、人工知能(AI)で生成された声が 彼らは、これまでのところ、大規模な出版社の範囲内でのみ、オーディオブックの出版を民主化します。
スペインでは、オーディオブック市場はまだ小さいです(スペイン語では30,000〜40,000のタイトルが発行されていますが、ドイツ語で200,000または英語で700,000のタイトルがあります)が、急速な拡大にあります。デジタルコンテンツディストリビューターDimarqueによる最近のレポートは、前年と比較して2024年までにセクターの成長を示しています。ユーザーの80%はサブスクリプションモデルにコミットしていますが、残りはユニットセールと図書館ローンの間に配布されています。これは昨年16%増加しました。
「私は、この10年の終わりまでに、5年以内に、 追い越し オーディオブックの人間に対する合成声の。そして、私はそれが保守的な予測だと思います。 「これは、ポッドキャストとオーディオブロスセクターのコンサルタントであり長い経験の起業家であるハビエル・セラヤによって見られます。」今日、世界中に出版された人々によってナレーションされた約130万人のAudiobrosがあります。しかし、AIとのプロダクションが成長しているリズムに合わせて、最も成熟したアングロサクソン市場で何が起こるかを見ると、彼らはすぐに残りを克服します」と彼は言います。
「すでに米国で起こっているように、これは非常に短期的には爆発すると確信しています」と、AIとのオーディオブックの制作に最も賭けているスペインの出版社の1人であるUranus EditionsのCEOであるJoaquínSabatéは考えています。このファミリービジネスは、すでに存在している他の人を編集の世界の特異性に適応させる独自の技術を開発しました。クライアントは、元の本と自分が探しているもの(声、トーン、音楽などの種類)についてのページの小さなスクリプトを配信するだけです。人間の癒しを組み込んで「一定レベルの品質を確保する」ツールは、通常、研究で作業を行う週と比較して、1日半でオーディオブロを準備することができます(ナレーションの1時間ごとは6時間から8時間の録音です)。
それが合成声の成功の理由です。生産コストは非常に低くなります。 「合成ナレーションを備えたオーディオブックは少なくとも10倍安くなっています。方向性の観点からは、約380ページの本には3,500〜5,000ユーロの費用がかかります。編集者の一部は多額のお金です。 「AIはオーディオブックを民主化し、小さな編集者がこの波に乗ることを許可すると思います」と彼は付け加えます。 「リスナーとして、より多くのコンテンツにアクセスできることは私にとって素晴らしいように思えます。AIのおかげで、私はこれまで以上に情報を得て面白いです」とCelaya氏は言います。 「翻訳者やイラストレーターですでに起こっているように、専門家が影響を受けるのは事実です。人間の声は引き続き要求されますが、高エンドの製品に対しても。」
アントニオ・アベノジャーは、オーディオブロスのナレーションの世界の先駆者です。 「私は40年前にイレブンから始めました。私にとっては学校でした」と彼は回想します。この吹き替え俳優、アナウンサー、62歳のディレクターは、AIが過去2〜3年で収入を減らし、50%」を減らしたと裏付けています。最近では、彼はドキュメンタリーのナレーションに特化しており、現時点では問題がありません。 「感情的な要素を要求しないものはすべてAIによって取られています。私たちはすでにそれを見ており、もっと進むでしょう」と彼は嘆きます。
「彼らはまだ改善しなければなりませんが、過去2年間で合成声で達成された品質は壮観です。特に人々がより多くの情熱を持ちたいと思うフィクションでは、人間の声はオーディオブックから消えないと思います」 「しかし、私たちは、消費者がエッセイに耳を傾けるときにナレーターをそれほど気にしないことを教えてくれる小さな市場調査を行ってきました。」
StoryTelなどの他の企業は、AIを連れて読者に新しい機能を貢献します。オーディオブックでは、このプラットフォームは、聴覚体験をカスタマイズするために、合成と人間の両方のさまざまな声を交互にするオプションを提供します。 「AIの声は、人間のナレーターを置き換えるのではなく、補完するために考えられています。この機能である音声スイッチャーは、英語、ポーランド語、スウェーデン語、フィン、デンマーク語の100を超えるタイトルで利用できるようになりました」エグゼクティブは、リスナーのかなりの割合がナレーターの音声のようではないために本を放棄したことを証明しているため、音声スイッチャーはそれらのユーザーを維持するのに役立つと考えています。
ナレーターがAIであるかどうかを知る方法は?
合成声はすでに非常に現実的です。解釈のニュアンスが相対的な体重が少ないノンフィクションオーディオブックに集中していることは事実ですが、私たちが聴いているエッセイが人を読んでいるのかマシンを読んでいるのかを区別することも非常に困難です。一部のプラットフォームやパブリッシャーは、コンテンツが従来の方法でナレーションされているかどうかを知らせないことで、それをより困難にしています。
「編集上のカモフラが人間の名前を起因するAIの使用を描く出血性の場合があります。彼らはオーディオブックに人工声を使用するだけでなく、同じ姓でその範囲のすべての声を特定します」 「これは、倫理的に異常であることに加えて、人工的な声に直面している情報を消費者に否定することです」と彼は付け加えます。
英国出版局協会がガイドを受けました によって生成された声によってナレーションされたオーディオブックをマークするため。 「AIの声」、不確定な数の実際の例から合成的に発達したものと、1つの音声のサンプルの割り当てによって構築された「認定された音声レプリカ」を区別します。ガイドはまた、「AIを使用したナレーションがタイトルメタデータに正式にマークされていることを確認することは編集者の責任であるべきだ」と述べています。協会は、物語の少なくとも10%が合成ツールで作られている場合、これを警告するのに適切であると考えています。英国オーディオエディターグループの社長であるジョンワットにとって、AIがナレーションするオーディオブックの急増を考えると、業界には編集者、小売業者、消費者がさまざまな種類のナレーションを区別できる国際言語を持っていることが重要です。
それは少なくとも今のところスペインで起こっていることではありません。 「彼らのオーディオブックがAIで生成された声によってナレーションされていると言うのは誰もあえてありません」と重要なオーディオコンテンツエディターのマネージャーは裏付けています。 Celayaは、「多くのプラットフォームへの恐怖は、オーディオブックがAIによってナレーションされていると言えば、製品は品質が低いと考えるだろう。食物セクターと同じように起こるだろう。消費者が私たちが食べるすべての材料をすべて知っていたなら、私たちはそれらを大いに好むが、私たちはそれらをとても気に入っているかもしれないが、多分私たちはいくつかの製品を買うのをやめるだろう」
しかし、それはすぐに変更する必要があります。彼 AIのガバナンス法の草案現在、公開協議段階で、「出力の結果をマークする」 [generados por IA] その人工的な性質を検出できるようにし、非違反の場合に強い罰金を確立します。それはオーディオブックのナレーションに影響しますか?」はい、声は解釈であり、既存の認識可能な声であるかどうかにかかわらず、まるでまったく新しいものであるかのように」とデジタル法に特化した法学者のボルジャ・アドスアラは言います。
「スペイン、イタリア、フランス、日本の社説との選択的同盟を通じてAIによって生成された音声テクノロジーでナレーションされた限られた数のタイトルを配布します」とAmazonが所有するAudibleプラットフォームのスポークスマンは言います。彼らの場合、彼らは、合成声で語られたすべてのタイトルが「明確に識別されている」と言います。
社説は、AIで作成されたオーディオブックの公開が提供できる法的問題とは異質ではありません。それらをマークする以外に、別の重要な問題があります。それらの合成声に対する権利です。 「トレーサビリティは非常に重要であり、各作品の語り手である著者は明確に定義されなければなりません。昨年、クローンされた声の代表者の最初の機関を構成します」とその代理店の機能を説明します。 」
#オーディオブックはAIに配信されます10年以内にほとんどすべての声が合成されますテクノロジー