ドイツのハイテク企業 DeepL が(ついに)音声テキスト化サービスを開始しました。これは DeepL Voice と呼ばれるもので、ライブまたはビデオでの会話の音声を翻訳されたテキストに変換します。
DeepL ユーザーは、理解できない言語で話している人々の話を聞き、理解できる言語に自動的にリアルタイムで翻訳できるようになりました。この新機能は現在、英語、ドイツ語、日本語、韓国語、スウェーデン語、オランダ語、フランス語、トルコ語、ポーランド語、ポルトガル語、ロシア語、スペイン語、イタリア語をサポートしています。
DeepL Voice の発売がエキサイティングなのは、これが「世界最高の」AI 翻訳者であると主張する同社のテキストツーテキスト製品と同じニューラル ネットワーク上で実行されることです。
外国に引っ越したばかりの私は、実際に使えそうな音声からテキストへの翻訳を試してみたいと思っています。私がこれまで試したものはすべてリアルタイムではなく、遅延があり、ほとんど役に立たず、翻訳の品質もかなり悪いです。
ウェビナー: Unicorn DNA: スケーリング成功の青写真
ユニコーンを構築するには何が必要ですか? 11 月 19 日午後 3 時(中央ヨーロッパ時間)、ユニコーン企業のトップが自社をトップに押し上げた考え方、戦略、革新的な考え方を明らかにします。
対面で会話する場合は、携帯電話で DeepL Voice を起動し、自分と他の話者の間に置くことができます。その後、会話が表示されるので、各人が 1 台のデバイスで簡単に翻訳を追うことができます。
DeepL Voice を Microsoft Teams に統合し、言語の壁を越えてビデオ会議を行うこともできます。翻訳されたテキストはサイドバーにキャプションとして表示されます。 DeepL Voice が Zoom や Google Meet などのプラットフォームですぐに利用できるようになるかどうかはまだわかりません。
「次なるフロンティア」
これは DeepL の最初のこのようなサービスですが、最後になる可能性は低いです。 DeepL の創設者兼 CEO のジャレク・クティロウスキー氏は、リアルタイム音声翻訳をビジネスの「次のフロンティア」と呼びました。
「DeepL はすでに書面翻訳のリーダーですが、リアルタイム音声翻訳はまったく別の話です」と DeepL の創設者兼 CEO のジャレク・クティロウスキー氏は述べています。
「音声をそのまま翻訳する場合、不完全な入力、発音の問題、遅延などに対処することになり、これらすべてが不正確な翻訳やユーザー エクスペリエンスの低下につながる可能性があります。
「そこで私たちは、これらを相殺して考慮し、企業が必要に応じて複数の言語でコミュニケーションできるようにすることで言語の壁を打ち破ることができるソリューションを構築しました」と Kutylowski 氏は述べています。
品質はおそらく、音声からテキストへの翻訳を提供する他の無数のプロバイダーとの DeepL Voice の差別化要因となるでしょう。
技術的な観点から見ると、DeepL の成功は、ニューラル ネットワークのアーキテクチャ、人間の編集者からの入力、およびトレーニング データにあります。しかしクティロウスキー氏は、競合他社に比べて重要な利点があるとも信じている。それは「集中力」だ。
5月、DeepLは3億ドル(2億7,700万ユーロ)の新たな投資を確保した後、評価額が20億ドルに達した。 32 の言語をカバーしており、100,000 人以上のビジネス ユーザーを数えています。
#DeepLDeepL #Voice #で #翻訳の次のフロンティアに挑戦