1736915074
2025-01-06 09:00:00
アノテーション可能性の紹介 – 人工ニューラル ネットワークがゲノム データのラベル付けをどのように学習するかを調べることで、生物学研究における大きな課題に対処する強力な新しいフレームワークです。ゲノム データセットには、アノテーションが付けられた大量のサンプルが含まれることがよくありますが、これらのサンプルの多くは、アノテーションが不正確または曖昧です。自然言語処理とコンピューター ビジョンの分野における最近の進歩を借りて、チームは人工ニューラル ネットワーク (ANN) を従来とは異なる方法で使用しました。単に ANN を使用して予測を行うのではなく、グループは学習の難易度を検査しました。さまざまな生体サンプルにラベルを付けるため。学生がいくつかの例を他の例より難しいと感じる理由を評価するのとほぼ同じように、チームはこの独自の情報源を活用して、細胞の注釈の不一致を特定し、データの解釈を改善し、発生と疾患に関連する主要な細胞経路を明らかにしました。注釈付け機能は、単一細胞のゲノム データを分析するためのより正確な方法を提供し、生物学研究を進歩させ、長期的には疾患の診断と治療を改善する大きな可能性をもたらします。
Nature Computational Scienceに掲載された、ヘブライ大学のジョナサン・カリン氏、レシェフ・ミンツ氏、バラク・ラヴェ博士、モー・ニッツァン博士が主導した新しい研究では、ディープニューラルネットワークのトレーニングダイナミクスをモニタリングすることによって、単一細胞および空間オミックスデータを解釈するための新しいフレームワークが導入されています。 。この研究は、細胞のアノテーションに固有の曖昧さに対処することを目的としており、複雑な生物学的データを理解するための新しいアプローチを提供します。
単細胞データと空間オミックスデータは、健康と病気における細胞の多様性と細胞の挙動を調査する私たちの能力を変革しました。ただし、これらの高次元データセットの解釈は、主に細胞の種類や状態などの離散的で正確な注釈を異種細胞集団に割り当てることが難しいため、困難です。これらの注釈は主観的でノイズが多く不完全であることが多く、データから有意義な洞察を抽出することが困難になります。
研究者らは、細胞の注釈の不一致を特定し、生物学的データ構造をより適切に特徴付けるのに役立つ新しいフレームワーク「注釈付け可能性」を開発しました。アノテーション可能性は、注釈付きデータに対するディープ ニューラル ネットワークのトレーニングのダイナミクスと難しさを監視することで、セルの注釈があいまいまたは誤っている領域を特定します。このアプローチは、細胞の中間状態と細胞発生の複雑で連続的な性質も強調します。
研究の一環として、研究チームは、生物学的シグナルのより正確な下流分析を可能にするシグナル認識グラフ埋め込み手法を導入しました。この技術は、標的シグナルに関連する細胞コミュニティを捕捉し、細胞の不均一性、発生経路、および疾患の軌跡の探索を容易にします。
この研究は、さまざまな単細胞 RNA シーケンスおよび空間オミクス データセットにわたるアノテーション可能性の適用可能性を実証しています。注目すべき発見には、誤った注釈の特定、発生および疾患関連の細胞状態の描写、細胞の不均一性のより適切な特徴付けが含まれます。この結果は、複雑な細胞の挙動を解明し、単一細胞レベルでの健康と病気の両方についての理解を進めるためのこのフレームワークの可能性を強調しています。
研究者らの研究は、ゲノムデータの解釈における重要な前進を示し、細胞の多様性を解明し、健康と病気の動態を研究する能力を高めるための強力なツールを提供する。
カリン J、ミンツ R、ラヴェ B、ニッツァン M.
ディープ ニューラル ネットワーク トレーニング ダイナミクスを使用した単一細胞および空間オミクス データの解釈。
ナット コンピューティング サイエンス2024 年 12 月;4(12):941-954。土井: 10.1038/s43588-024-00721-5
#AIの学習曲線を追跡して複雑なゲノムデータを解読する新しい方法