1763273005
2025-11-16 01:34:00
私たちが考えた文章を効果的に書かれた文章に変換できるテクノロジーは大きく進歩しました。しかし、心の中のイメージをテキストに変換するのははるかに難しいように思えました。もっとも、日本人の堀川智康はこれにほぼ成功しているが。 「マインドキャプション」として知られる彼の新しい方法は、AI を使用して脳内の情報を反映する説明文を生成します。これは、オブジェクト、場所、アクション、イベント、さらにはそれらの間の関係などの視覚的な詳細に関係します。
堀川氏はまず、ビデオを見ている男性4人と女性2人の脳活動を分析した。対象は22歳から37歳までの6人で、全員が日本語を母語とする。 6人は数秒間の音声なしのビデオを合計2,180本視聴した。内容はオブジェクト、シーン、アクションごとに異なります。
次に、訓練された AI システムがビデオからキャプションを作成し、それらのキャプションを一連の数字に変換しました。堀川氏はまた、ビデオクリップに関連するスキャンされた脳活動を数値シーケンスにリンクするために、別個のより単純な AI モデル、いわゆる「デコーダー」をトレーニングしました。次に、デコーダーを使用して、参加者がトレーニング プロセス中に AI システムが見なかったビデオを見たり思い出したりするときの脳活動を解釈しました。デコードされた脳の活動に最もよく一致する単語シーケンスを段階的に生成する別のアルゴリズムも開発されました。
AI がデータから学習するにつれて、説明テキスト ツールは脳スキャンを使用して参加者が視聴したビデオを説明するのがますますうまくなりました。
失語症
堀川氏の研究は11月5日付けの科学誌に掲載された 科学は進歩します。 そして、それは、例えば、脳損傷の結果、言語を発したり理解したりすることが困難な失語症の人にとって、大きな変化をもたらす可能性があります。実際、堀川氏の方法は、言語関連の脳領域、つまり「言語ネットワーク」の活動を利用しなくても、視覚コンテンツの豊富な記述を作成できます。 「これは、誰かがその言語ネットワークに損害を被った場合でも、この方法が使用できることを示しています。」
彼はすぐにコメントをしなければなりませんが。彼の方法は現在でも非常に大規模なデータセットと参加者の積極的な協力を必要とします。そのため、この技術は神経科学の研究には役立つものの、「実用化するにはそれほど正確ではない」と同氏は述べた。
さらに、プライバシーに関する質問も数多くあります。これは「人の心を読む」ことへの扉を開くのでしょうか?たとえその人が気づいていないとしても?では、赤ちゃんや動物はどうでしょうか?日本人自身もすぐに安心させた。この技術はまだそこまで進んでいません。 「このテクノロジーが精神的プライバシーに重大なリスクをもたらすのではないかと心配する人もいるが」、実際のところ、現在のアプローチでは「個人のプライベートな考えを簡単に読み取ることはできない」。
#日本の科学者は画期的な技術を使って人々の考えをテキストに変換できる