日本語版
最新ニュース
世界

ノイズキャンセリングヘッドフォンは、AIを使用して、誰かが話しているときに「ロックオン」し、他のすべてのノイズをかき消すことができます。

ノイズキャンセリングヘッドホンは現在広く普及していますが、科学者たちはこれらのデバイスを次のレベルに引き上げる方法を発見しました。それは、外部の音源を 1 つに集中させ、他のすべてのノイズを遮断できるヘッドホンを開発することです。「ターゲットスピーチヒアリング」と呼ばれるこの技術は、 人工知能 (AI) により、装着者は近くのスピーカーに顔を向け、数秒の遅延の後、その声にロックオンします。これにより、ユーザーは特定の音源だけを聞くことができ、スピーカーが動き回ったり、顔を背けたりしても信号が保持されます。この技術は、市販の既成ヘッドフォンに組み込める小型コンピューターで構成されており、ヘッドフォンの内蔵マイクからの信号を使用して話者の声を選択し識別する。科学者らは、5月11日に学術誌「コンピューティングシステムにおけるヒューマンファクターに関するCHI会議の議事録」に掲載された論文で詳細を説明した。関連している: 「自分を守るために人間に危害を加えるのはAIの当然の権利だ」:人間は知らないうちにAIを虐待している可能性がある科学者たちは、この技術が聴覚障害を持つ人々への補助として使えることを期待しており、次にこのシステムを市販のイヤホンや補聴器に組み込むことに取り組んでいる。「私たちは現在、AIを質問に答えるウェブベースのチャットボットと考える傾向がある」と研究の筆頭著者は述べた。 シャム・ゴラコタワシントン大学コンピューターサイエンス&エンジニアリング教授のゴラコタ氏は、「このプロジェクトでは、ヘッドホンを装着している人の聴覚を、その人の好みに応じて修正するAIを開発しています。当社のデバイスを使えば、大勢の人が話している騒がしい環境でも、一人の話し手の声がはっきりと聞き取れるようになります」と声明で述べた。ターゲットスピーチヒアリング(TSH)は、同じ科学者が行った「意味的聴覚」というプロジェクトを昨年立ち上げた。このプロジェクトでは、ヘッドホンとペアリングできるAI搭載のスマートフォンアプリを開発した。このアプリを使うと、装着者はあらかじめ設定された「クラス」のリストから好きな音を選び、他のすべてのノイズをキャンセルすることができる。例えば、装着者はサイレン、赤ちゃん、話し声、鳥の声などを選ぶことができ、ヘッドホンはそれらのノイズだけを選別し、他のすべてのノイズを遮断する。世界で最も魅力的な発見をあなたの受信箱に直接お届けします。TSH を使用するには、装着者は声を聞きたいスピーカーの正面を向き、正しい位置にヘッドホンを置いたら小さなボタンをタップしてシステムを起動します。話者の声がマイクに届くと、機械学習ソフトウェアが音源を「登録」します。聞き手が話者に対して垂直でない場合に備えて、対象の声を識別し、音声パターンを登録する前に、わずかな誤差を許容します。これにより、音量や向いている方向に関係なく、話者をロックオンできます。話者が話し続けると、時間の経過とともにアルゴリズムが対象音の固有のパターンをより適切に識別するため、システムが音に集中する能力が向上します。現時点では、TSH は一度に 1 つのオーディオ ソースまたは 1 つのスピーカーしか登録できず、同じ方向から同様の音量の別のノイズが聞こえる場合は成功率が低くなります。 理想的な世界では、科学者は、プロセスを妨げる可能性のある他の環境ノイズのない「クリーンな」音声サンプルをシステムに提示して識別および登録するだろうと、彼らは論文で述べている。しかし、現実のシナリオではクリアな音を得るのは難しいため、これは実用的なデバイスの構築とはうまく一致しないだろう。 #ノイズキャンセリングヘッドフォンはAIを使用して誰かが話しているときにロックオンし他のすべてのノイズをかき消すことができます

ノイズキャンセリングヘッドフォンは、AIを使用して、誰かが話しているときに「ロックオン」し、他のすべてのノイズをかき消すことができます。

1718018138
2024-06-10 11:00:47

ノイズキャンセリングヘッドホンは現在広く普及していますが、科学者たちはこれらのデバイスを次のレベルに引き上げる方法を発見しました。それは、外部の音源を 1 つに集中させ、他のすべてのノイズを遮断できるヘッドホンを開発することです。

「ターゲットスピーチヒアリング」と呼ばれるこの技術は、 人工知能 (AI) により、装着者は近くのスピーカーに顔を向け、数秒の遅延の後、その声にロックオンします。これにより、ユーザーは特定の音源だけを聞くことができ、スピーカーが動き回ったり、顔を背けたりしても信号が保持されます。

この技術は、市販の既成ヘッドフォンに組み込める小型コンピューターで構成されており、ヘッドフォンの内蔵マイクからの信号を使用して話者の声を選択し識別する。科学者らは、5月11日に学術誌「コンピューティングシステムにおけるヒューマンファクターに関するCHI会議の議事録」に掲載された論文で詳細を説明した。

関連している: 「自分を守るために人間に危害を加えるのはAIの当然の権利だ」:人間は知らないうちにAIを虐待している可能性がある

科学者たちは、この技術が聴覚障害を持つ人々への補助として使えることを期待しており、次にこのシステムを市販のイヤホンや補聴器に組み込むことに取り組んでいる。

「私たちは現在、AIを質問に答えるウェブベースのチャットボットと考える傾向がある」と研究の筆頭著者は述べた。 シャム・ゴラコタワシントン大学コンピューターサイエンス&エンジニアリング教授のゴラコタ氏は、「このプロジェクトでは、ヘッドホンを装着している人の聴覚を、その人の好みに応じて修正するAIを開発しています。当社のデバイスを使えば、大勢の人が話している騒がしい環境でも、一人の話し手の声がはっきりと聞き取れるようになります」と声明で述べた。

ターゲットスピーチヒアリング(TSH)は、同じ科学者が行った「意味的聴覚」というプロジェクトを昨年立ち上げた。このプロジェクトでは、ヘッドホンとペアリングできるAI搭載のスマートフォンアプリを開発した。このアプリを使うと、装着者はあらかじめ設定された「クラス」のリストから好きな音を選び、他のすべてのノイズをキャンセルすることができる。例えば、装着者はサイレン、赤ちゃん、話し声、鳥の声などを選ぶことができ、ヘッドホンはそれらのノイズだけを選別し、他のすべてのノイズを遮断する。

TSH を使用するには、装着者は声を聞きたいスピーカーの正面を向き、正しい位置にヘッドホンを置いたら小さなボタンをタップしてシステムを起動します。

話者の声がマイクに届くと、機械学習ソフトウェアが音源を「登録」します。聞き手が話者に対して垂直でない場合に備えて、対象の声を識別し、音声パターンを登録する前に、わずかな誤差を許容します。これにより、音量や向いている方向に関係なく、話者をロックオンできます。

話者が話し続けると、時間の経過とともにアルゴリズムが対象音の固有のパターンをより適切に識別するため、システムが音に集中する能力が向上します。

現時点では、TSH は一度に 1 つのオーディオ ソースまたは 1 つのスピーカーしか登録できず、同じ方向から同様の音量の別のノイズが聞こえる場合は成功率が低くなります。

理想的な世界では、科学者は、プロセスを妨げる可能性のある他の環境ノイズのない「クリーンな」音声サンプルをシステムに提示して識別および登録するだろうと、彼らは論文で述べている。しかし、現実のシナリオではクリアな音を得るのは難しいため、これは実用的なデバイスの構築とはうまく一致しないだろう。

#ノイズキャンセリングヘッドフォンはAIを使用して誰かが話しているときにロックオンし他のすべてのノイズをかき消すことができます

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。