日本語版
最新ニュース
日本

メタAIツールllamaはほぼ完全に覚えたハリーポッターの本、Study Finds

メタのラマモデルは記憶されています ハリー・ポッターと魔術師の石 そのため、本の42%からの逐語的な抜粋を再現できるほどです 新しい研究。 スタンフォード、コーネル、ウェストバージニア大学の研究者は、今や派手なものから数十本の本を分析しました books3データセット、メタのラマモデルを訓練するために使用される海賊版のコレクション。 Books3は、メタに対する著作権侵害訴訟の中心にもあります。 Kadreyv。MetaPlatforms、Inc。 この研究の著者は、彼らの調査結果が同様の訴訟に直面しているAI企業に大きな影響を与える可能性があると述べています。研究論文によると、llama 3.1モデルは「いくつかの本を記憶しています。 ハリー・ポッター そして 1984年具体的には、Llama 3.1が最初のハリーポッターの本の42%を非常によく記憶しているため、逐語的な抜粋を少なくとも50%の時間を再現できることがわかりました。「books 3データセットからの本の逐語的な暗記の程度は、以前に説明したよりも重要です」と論文は述べた。しかし、研究者はまた、「暗記はモデルごとに大きく異なること、および各モデル内の本ごとに、そして個々の本のさまざまな部分で異なる」ことを発見しました。たとえば、この調査では、Llama 3.1が0.13%のみを記憶したと推定しました。 サンドマンスリム リチャード・カドリー、メタに対する集団訴訟著作権訴訟の主要な原告の一人。したがって、紙の調査結果のいくつかはひどいように見えますが、原告のための喫煙銃と呼ばないでください AI著作権侵害ケース。「これらの結果は、AIの著作権討論の全員に何かをラッチするために何かを与えます」 書いた ジャーナリストのティモシー・B・リーは、AIニュースレターを理解しています。 「このような発散した結果は、JKローリング、リチャードカドリー、および他の何千人もの著者を単一の大規模な訴訟でまとめるのが理にかなっているかどうかに疑問を投げかける可能性があります。なぜラマは他の本よりもいくつかの本を再現できるのですか? 「違いは、ハリー・ポッターがはるかに有名な本だからだと思う。それは広く引用されており、サードパーティのウェブサイトでの大幅な抜粋がウェブ上のトレーニングデータに登場したと確信している」と語った。 ジェームズ・グリムメルマン、コーネル大学のデジタルおよび情報法の教授。彼は論文で引用されました。これが示しているのは、「AI企業は暗記を増やすか減少させる選択をすることができる。これはAIの避けられない特徴ではない。彼らはそれを制御できる」ということだと言った。メタおよび他のAI企業は、著作権で保護された作品を使用してモデルを訓練することは、複雑な法的教義であるフェアユースの下で保護されていると主張しています。しかし、暗記の程度はそれらの議論を複雑にする可能性があります。「はい、LLMが以前に考えられていた以上に著作権分析を変える可能性があると思います。」 ロバート・ブラウン、ジョージワシントン大学ロースクールの教授は、Mashableへのメールで述べた。彼は、この調査結果が最終的にメタの公正使用の議論を弱める可能性があると結論付けました。研究の調査結果についてメタにコメントを求めました。回答を受け取った場合は、この記事を更新します。開示:Mashableの親会社であるZiff Davisは、4月にOpenaiに対して訴訟を起こし、AIシステムのトレーニングと運営におけるZiff Davisの著作権を侵害したと主張しました。 #メタAIツールllamaはほぼ完全に覚えたハリーポッターの本Study #Finds

メタAIツールllamaはほぼ完全に覚えたハリーポッターの本、Study Finds

1750202581
2025-06-17 18:54:00

メタのラマモデルは記憶されています ハリー・ポッターと魔術師の石 そのため、本の42%からの逐語的な抜粋を再現できるほどです 新しい研究

スタンフォード、コーネル、ウェストバージニア大学の研究者は、今や派手なものから数十本の本を分析しました books3データセット、メタのラマモデルを訓練するために使用される海賊版のコレクション。 Books3は、メタに対する著作権侵害訴訟の中心にもあります。 Kadreyv。MetaPlatforms、Inc この研究の著者は、彼らの調査結果が同様の訴訟に直面しているAI企業に大きな影響を与える可能性があると述べています。

研究論文によると、llama 3.1モデルは「いくつかの本を記憶しています。 ハリー・ポッター そして 1984年具体的には、Llama 3.1が最初のハリーポッターの本の42%を非常によく記憶しているため、逐語的な抜粋を少なくとも50%の時間を再現できることがわかりました。

「books 3データセットからの本の逐語的な暗記の程度は、以前に説明したよりも重要です」と論文は述べた。しかし、研究者はまた、「暗記はモデルごとに大きく異なること、および各モデル内の本ごとに、そして個々の本のさまざまな部分で異なる」ことを発見しました。たとえば、この調査では、Llama 3.1が0.13%のみを記憶したと推定しました。 サンドマンスリム リチャード・カドリー、メタに対する集団訴訟著作権訴訟の主要な原告の一人。

したがって、紙の調査結果のいくつかはひどいように見えますが、原告のための喫煙銃と呼ばないでください AI著作権侵害ケース

「これらの結果は、AIの著作権討論の全員に何かをラッチするために何かを与えます」 書いた ジャーナリストのティモシー・B・リーは、AIニュースレターを理解しています。 「このような発散した結果は、JKローリング、リチャードカドリー、および他の何千人もの著者を単一の大規模な訴訟でまとめるのが理にかなっているかどうかに疑問を投げかける可能性があります。

なぜラマは他の本よりもいくつかの本を再現できるのですか? 「違いは、ハリー・ポッターがはるかに有名な本だからだと思う。それは広く引用されており、サードパーティのウェブサイトでの大幅な抜粋がウェブ上のトレーニングデータに登場したと確信している」と語った。 ジェームズ・グリムメルマン、コーネル大学のデジタルおよび情報法の教授。彼は論文で引用されました。

これが示しているのは、「AI企業は暗記を増やすか減少させる選択をすることができる。これはAIの避けられない特徴ではない。彼らはそれを制御できる」ということだと言った。

メタおよび他のAI企業は、著作権で保護された作品を使用してモデルを訓練することは、複雑な法的教義であるフェアユースの下で保護されていると主張しています。しかし、暗記の程度はそれらの議論を複雑にする可能性があります。

「はい、LLMが以前に考えられていた以上に著作権分析を変える可能性があると思います。」 ロバート・ブラウン、ジョージワシントン大学ロースクールの教授は、Mashableへのメールで述べた。彼は、この調査結果が最終的にメタの公正使用の議論を弱める可能性があると結論付けました。

研究の調査結果についてメタにコメントを求めました。回答を受け取った場合は、この記事を更新します。


開示:Mashableの親会社であるZiff Davisは、4月にOpenaiに対して訴訟を起こし、AIシステムのトレーニングと運営におけるZiff Davisの著作権を侵害したと主張しました。

#メタAIツールllamaはほぼ完全に覚えたハリーポッターの本Study #Finds

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。