木曜日にオンタリオ州高等裁判所に起こされたこの訴訟は、OpenAIが報道機関を犠牲にして「不当に富を得た」としている。訴状によれば、「OpenAIによって違法に取得されたデータと知的財産は、ニュースメディア企業とそのジャーナリスト、編集者、スタッフの多大な時間、労力、コストの産物である」としている。
「OpenAIは、ニュースメディア企業の貴重な知的財産を厚かましくも悪用し、同意も検討もなしに商業利用を含む自社利用に転用することを選択した。」
いずれの申し立ても法廷で証明されていない。
原告には、ポストメディア ネットワーク社、トロント スター ニュースレターズ社、メトロランド メディア グループ、カナディアン プレス社、ラジオ カナダ社も含まれます。
OpenAIは電子メールでの声明で、同社はまだ疑惑を精査していないと述べたが、同社のAIモデルは公開されているデータに基づいてトレーニングされていると付け加えた。同社はまた、パブリッシャーがコンテンツへのアクセスをオプトアウトできるようにしていると声明で述べた。
報道各社は金曜日の共同声明で次のように述べた:「自社の商業的利益のために他社の知的財産を使用することが何らかの形で公平である、あるいは公共の利益になるというOpenAIの公式声明は間違っている。ジャーナリズムは公共の利益にかなうものです。 OpenAI が自社の商業的利益のために他社のジャーナリズムを利用することはありません。それは違法です。」
報道機関は、OpenAIが侵害したとされる作品1件につき2万ドルに達する可能性がある損害賠償を求めている。この訴訟では、同社がこれらの行為を継続することを差し止める差し止め命令も求めている。
この訴訟は、報道機関、作家、アーティストがAI企業に対して起こした多くの訴訟のうちの1つである。生成 AI はテキスト、画像、その他のメディアを生成するアプリケーションを指しますが、適切に動作するには大量のデータが必要です。これらのモデルはデータ内のパターンを見つけて、たとえば文内の次の単語を予測できるようにします。
訴状によれば、その間、報道各社は少なくとも約1,610万件の所有およびライセンスされた著作物を出版したという。 OpenAIがいつどのようにしてこの資料にアクセスしたとされるのかについての完全な詳細は原告には知られていない、と訴状には記されている。
AI企業は通常、トレーニングデータセットにどのような素材が使用されているかを明らかにしておらず、競争の激化や法的懸念のため、近年はますます口を閉ざすようになっている。
Cohere Inc.やGoogleなどのAI開発企業は提出書類の中で、権利者からの補償や許可の取得を強制されることなく、データを使用して商用モデルを構築できるようにするための明示的な免除を支持すると述べ、そのような要件は、カナダのAI産業。
レンチュナー・スラートのパートナーで報道機関の代表を務めるサナ・ハルワニ氏は、OpenAIの活動はフェアディーリングの免除対象には該当しないと述べた。 「彼らは人々に製品を提供する営利団体です。したがって、私たちの見解では、それらは例外全体から除外されます」と彼女は言いました。
彼女はまた、AI企業が「公開されている」素材を使ってトレーニングを行っているという主張にも異議を唱えた。 「図書館に本を借りに行っても、それは一般に公開されています。だからといって、コピーして販売することが許されるわけではありません」と彼女は言う。
ヨーク大学の法学教授で知財を専門とするピナ・ダゴスティーノ氏は、政府は明確にする必要があると述べた。 「新しいテクノロジーが登場するたびに、私たちは同じ問題や同じ訴訟に直面し続けています」と彼女は言いました。 「この訴訟は、政府がリーダーシップを発揮し、法律を導入するよう求める合図となるはずです。」
OpenAI は、ニュースを含むトレーニング データでコンテンツを使用するために、多くの報道機関や出版社とライセンス契約を締結しました。 Corp、フィナンシャル・タイムズおよびAP通信。
#CBCやThe #Globeなどのカナダの報道機関が著作権侵害の疑いでChatGPT作成者を告訴