日本語版
最新ニュース
日本

ボルヘスの83年前の短編小説がインターネットの暗い未来を予感させる

この記事はの一部です TPMカフェ、TPM の意見やニュース分析のホームです。最初に公開されたのは、 会話。インターネットは今後数十年でどのように進化するのでしょうか?小説家たちはいくつかの可能性を模索してきました。彼の2019年の小説『秋」SF作家 ニール・スティーブンソン インターネットがまだ存在する近未来を想像しました。しかし、誤った情報、偽情報、広告で汚染されすぎて、ほとんど使用できなくなっています。スティーブンソンの小説の登場人物たちは、人間が選択した信頼できるニュースや情報である「編集ストリーム」を購読することでこの問題に対処します。欠点は、このようなオーダーメイドのサービスを提供できるのは富裕層だけであり、人類のほとんどは低品質で厳選されていないオンライン コンテンツを消費することになっているということです。ある程度、これはすでに起こっています。ニューヨーク・タイムズやウォール・ストリート・ジャーナルなどの多くの報道機関は、厳選したコンテンツをペイウォールの内側に配置しています。その間、 誤った情報が蔓延する XやTikTokなどのソーシャルメディアプラットフォームで。スティーブンソンの予言者としての実績は印象的だった。 メタバースを予期していた 1992 年の彼の小説の中で、スノークラッシュ」、そして彼の「」の重要なプロット要素ダイヤモンドエイジ」は1995年に発売されたインタラクティブな入門書です。 チャットボットとよく似ています。表面的には、チャットボットは誤った情報の蔓延に対する解決策を提供しているように見えます。事実に基づくコンテンツを配信することで、チャットボットはペイウォールによって遮断されていない高品質の情報の代替ソースを提供できる可能性があります。しかし皮肉なことに、これらのチャットボットの出力はウェブの将来に対する最大の危険を表している可能性があります。それはアルゼンチンの作家によって数十年前に示唆されていました。 ホルヘ・ルイス・ボルヘス。チャットボットの台頭今日でも、インターネットのかなりの部分は、査読、ファクトチェック、または何らかの方法で精査された記事や書籍など、事実に基づく、表向きは真実であるコンテンツで構成されています。大規模言語モデル (LLM) (ChatGPT、Copilot、Gemini などのボットを動かすエンジン) の開発者は、このリソースを活用しています。ただし、魔法を実行するには、これらのモデルは摂取する必要があります 膨大な量 トレーニングを目的とした高品質のテキスト。すでに膨大な量の言葉がオンライン ソースから収集され、駆け出しの LLM に提供されています。問題は、ウェブは巨大ではありますが、有限のリソースであるということです。ストリップマイニングがまだ行われていない高品質のテキストは、 不足しつつある、ニューヨーク・タイムズ紙が「コンテンツに新たな危機が訪れる」このため、OpenAI のような企業は、 協定を結ぶ 出版社と協力して、貪欲なボット用の原材料をさらに入手します。しかし、ある予測によると、追加の高品質トレーニング データの不足が発生する可能性があります。 早ければ2026年までに。チャットボットの出力は最終的にオンラインになるため、これらの第 2 世代のテキストは、「」と呼ばれる捏造された情報で完成します。幻覚”、また、次のような提案などの完全な間違いも含まれます。 ピザに接着剤を塗る – ウェブをさらに汚染します。そして、チャットボットがオンラインで間違った種類の人々とつるむと、彼らの嫌な意見を拾ってしまう可能性があります。 Microsoft は 2016 年にこれを困難な方法で発見しました。…

ボルヘスの83年前の短編小説がインターネットの暗い未来を予感させる

1732904520
2024-11-29 18:00:00

この記事はの一部です TPMカフェ、TPM の意見やニュース分析のホームです。最初に公開されたのは、 会話

インターネットは今後数十年でどのように進化するのでしょうか?

小説家たちはいくつかの可能性を模索してきました。

彼の2019年の小説『」SF作家 ニール・スティーブンソン インターネットがまだ存在する近未来を想像しました。しかし、誤った情報、偽情報、広告で汚染されすぎて、ほとんど使用できなくなっています。

スティーブンソンの小説の登場人物たちは、人間が選択した信頼できるニュースや情報である「編集ストリーム」を購読することでこの問題に対処します。

欠点は、このようなオーダーメイドのサービスを提供できるのは富裕層だけであり、人類のほとんどは低品質で厳選されていないオンライン コンテンツを消費することになっているということです。

ある程度、これはすでに起こっています。ニューヨーク・タイムズやウォール・ストリート・ジャーナルなどの多くの報道機関は、厳選したコンテンツをペイウォールの内側に配置しています。その間、 誤った情報が蔓延する XやTikTokなどのソーシャルメディアプラットフォームで。

スティーブンソンの予言者としての実績は印象的だった。 メタバースを予期していた 1992 年の彼の小説の中で、スノークラッシュ」、そして彼の「」の重要なプロット要素ダイヤモンドエイジ」は1995年に発売されたインタラクティブな入門書です。 チャットボットとよく似ています

表面的には、チャットボットは誤った情報の蔓延に対する解決策を提供しているように見えます。事実に基づくコンテンツを配信することで、チャットボットはペイウォールによって遮断されていない高品質の情報の代替ソースを提供できる可能性があります。

しかし皮肉なことに、これらのチャットボットの出力はウェブの将来に対する最大の危険を表している可能性があります。それはアルゼンチンの作家によって数十年前に示唆されていました。 ホルヘ・ルイス・ボルヘス

チャットボットの台頭

今日でも、インターネットのかなりの部分は、査読、ファクトチェック、または何らかの方法で精査された記事や書籍など、事実に基づく、表向きは真実であるコンテンツで構成されています。

大規模言語モデル (LLM) (ChatGPT、Copilot、Gemini などのボットを動かすエンジン) の開発者は、このリソースを活用しています。

ただし、魔法を実行するには、これらのモデルは摂取する必要があります 膨大な量 トレーニングを目的とした高品質のテキスト。すでに膨大な量の言葉がオンライン ソースから収集され、駆け出しの LLM に提供されています。

問題は、ウェブは巨大ではありますが、有限のリソースであるということです。ストリップマイニングがまだ行われていない高品質のテキストは、 不足しつつある、ニューヨーク・タイムズ紙が「コンテンツに新たな危機が訪れる

このため、OpenAI のような企業は、 協定を結ぶ 出版社と協力して、貪欲なボット用の原材料をさらに入手します。しかし、ある予測によると、追加の高品質トレーニング データの不足が発生する可能性があります。 早ければ2026年までに

チャットボットの出力は最終的にオンラインになるため、これらの第 2 世代のテキストは、「」と呼ばれる捏造された情報で完成します。幻覚”、また、次のような提案などの完全な間違いも含まれます。 ピザに接着剤を塗る – ウェブをさらに汚染します。

そして、チャットボットがオンラインで間違った種類の人々とつるむと、彼らの嫌な意見を拾ってしまう可能性があります。 Microsoft は 2016 年にこれを困難な方法で発見しました。 テイのプラグを抜かなければならなかった、繰り返し始めたボット 人種差別的および性差別的なコンテンツ

時間が経つにつれて、これらすべての問題により、オンライン コンテンツが均一になる可能性があります 信頼性が低い そして今日よりも役に立たない。さらに、低カロリーの食事を与えられている LLM は、さらに問題のある出力を生成し、それが Web 上に掲載される可能性があります。

無限で役に立たないライブラリ

ボットが自身の不完全な出力をフィードするため、フィードバック ループが継続的な劣化プロセスを引き起こすことを想像するのは難しくありません。

2024 年 7 月の論文 Nature に掲載された論文では、再帰的に生成されたデータに基づいて AI モデルをトレーニングした場合の結果を調査しました。 「不可逆的な欠陥」が「」を引き起こす可能性があることを示しました。モデルの崩壊」 この方法でトレーニングされたシステムの場合、画像のコピーとそのコピーのコピー、そしてそのコピーのコピーと同じように、元の画像に対する忠実性が失われます。

これはどの程度悪化する可能性がありますか?

ボルヘスの 1941 年の短編小説を考えてみましょう。バベルの図書館」コンピューター科学者より 50 年前 ティム・バーナーズ・リー ボルヘスはウェブのアーキテクチャを作成しましたが、ボルヘスはすでにアナログの同等のものを想像していました。

3,000 語の物語の中で、作家は巨大な、おそらくは無限の数の六角形の部屋で構成される世界を想像します。各部屋の本棚には、住民が直観的にアルファベットのあらゆる文字の組み合わせが含まれているに違いない均一な冊子が収められています。

最初は、この認識に喜びが湧き上がります。定義上、人類の将来と人生の意味を詳述する本は存在するはずです。

住民たちはそのような本を探しますが、大部分には意味のない文字の組み合わせしか含まれていないことがわかります。真実はそこにありますが、考えられるあらゆる嘘もまた存在します。そしてそのすべてが、想像を絶する膨大な量の意味不明な内容に埋め込まれています。

何世紀にもわたる探索の後でも、意味のある断片はほんのわずかしか見つかりません。そしてそれでも、これらの一貫した文章が真実なのか嘘なのかを判断する方法はありません。希望は絶望に変わります。

ウェブは非常に汚染され、富裕層だけが正確で信頼できる情報を入手できるようになるのでしょうか?それとも、無数のチャットボットが大量の汚染された言葉を生成し、オンラインで正確な情報を見つけることが干し草の山から針を探すようなものになるのでしょうか?

インターネットは人類の偉大な成果の 1 つであるとよく言われます。しかし、他のリソースと同様に、ボルヘスが想像したディストピアのビジョンに直面することのないように、それがどのように維持および管理されるかを真剣に考えることが重要です。

この記事はから転載されています 会話 クリエイティブ・コモンズ・ライセンスに基づいて。読んでください 元の記事


#ボルヘスの83年前の短編小説がインターネットの暗い未来を予感させる

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。