1744695211
2025-04-14 19:50:00
イルカを理解することは、もはや海洋世界のエトロジストやファンにとっての夢ではありません:今日、ありがとう人工知能人間とクサシ人の間のより深いコミュニケーションに開かれた新しいトレイル。機会に 世界デルフィーニの日、 グーグル 並外れた結果を発表しました: Dolphinxコラボレーションで開発するモデル ジョージア工科大学 そして WDP (野生のイルカプロジェクト)、イルカの発声を分析し、現実的な方法で新しい同様のサウンドを生成することができます。このプロジェクトは、重要な前進を表しています 大西洋のマクオラット・イルカの「言語」の理解 (Stenella frontalis)、30年以上にわたって詳細に研究された種。
水中で収集された膨大な量のデータを高度なサウンドアルゴリズムと組み合わせることにより、Dolphingemmaは再発性の音パターンを特定し、種間のインタラクティブなコミュニケーションへの方法を開くことができます。そして、それはここで終わりません:呼ばれるシステムを通して チャット動物との相互作用を促進するために人工音を使用して、2つのウェイウェイダイアログの形態もテストされています。
イルフィンゲンマモデルの誕生
何十年もの間、イルカの言語は魅力的な謎でした。フルート、クリック、ニン、衝動的なサウンドは研究者のサウンドアーカイブを満たしましたが、その重要性を解釈することは常に複雑な作業でした。 野生のイルカプロジェクト1985年以来、バハマスウォーターズで活動していた彼は、単一のイルカの社会で実施された最長のフィールド調査を実施しました。彼の非侵襲的アプローチ – 「彼らの世界の関係、彼らの関係に」というモットーに要約された – は、単一のアーカイブを収集することを可能にしました。これらのデータ資産により、開始が可能になりました 特定の音を再発性の行動状況に接続します:たとえばi 「特徴的なホイッスル」正しい名前と同様に、お互いを覚えているために使用されるか «Squawk» 個人間の紛争に関連する断続的。
これは非常に豊かです 体 Googleテクノロジーが束縛されたこと。 Dolphinx 1つです 高度なオーディオモデル アーキテクチャに基づいています ペル一連の光とオープンの言語モデル。テキストモデルとは異なり、 イルフィンゲンマはサウンドインとサウンドアウトです:イルカのサウンドシーケンスを聞き、内部構造を分析し、単語で予測的な言語モデルが行うのと同じように、継続的な継続を生成します。基本テクノロジーは依存します サウンドストリーム複雑なボーカルシグナルを効果的に表すことができる健全な幼児と、ほぼのモデル 4億パラメータースマートフォンでも動作するサイズ、特にi Google Pixel フィールドで直接使用。
自然な音の分析に加えて、プロジェクトには別の研究面が含まれています。 双方向コミュニケーション。ここにシステムがあります チャット (子宮子った聴覚補強テレメトリー)、ジョージア工科大学で開発された水中インターフェイス。チャットは、言語をイルカに直接翻訳することではなく、人工ホイッスルから共有の語彙を作成することを目指しています。これらの音は、藻類やゲームなどのイルカを持つ家族のオブジェクトに関連付けられており、自然な文脈で提示されます。イルカが対応するフルートを模倣する場合、彼は問題のオブジェクトを受け取ることができ、したがって関連性を強化することができます。
これらの実験でGoogleピクセル携帯電話を使用することは、重要な利点を表しています。特定のハードウェアの必要性、コストの削減、消費、および機器のサイズを減らすことができます。 Pixel 9などのスマートフォン「Big G」の最新モデルは、両方のモデルを実行できます 深い学習 のアルゴリズムとしてのイルカとして マルッチつまり、すでに既知の音と比較して、イルカの発声に迅速に対応するシステムの能力が向上します。したがって、研究者は骨コードヘッドフォンを介してすぐにフィードバックを受け取り、海洋環境に没頭したままです。
科学コミュニティへのプロジェクトの開設
プロジェクトの重要な側面は彼です 科学コミュニティのためにオープンします。 Googleは、Dolphingemmaを共有すると発表しました 2025年のオープンソースモデルToursopyやDolphinsなどの長い説教壇などの他の種類の介感者とも協力している研究者が利用できるようにします。モデルを各種の特定の発声に適応させる必要がありますが、イルフィンゲンマのモジュール構造は、その適応とスケーラビリティを促進します。
#Dolphingemmaイルカの言語を解釈する新しいGoogleAIモデル