1719700646
2024-06-29 16:35:00
生産性の高い AI の利用拡大をめぐる最大の論争の 1 つは、AI をトレーニングする企業が 人工知能 モデルは、コンテンツ作成者によって著作権で保護された Web データを使用する場合があります。 これにより、Copilot、ChatGPT、その他の LLM がアクセス権のないデータでトレーニングされているとして、新聞社、著者、その他のメディア企業が Microsoft を含む製造 AI 企業に対していくつかの訴訟を起こしています。
今週は、先生 ムスタファ・スレイマン、最近新しい AI 部門の CEO に任命された マイクロソフト、アスペンアイデアフェスティバル中にインタビューに答えました。 CNBCのアンドリュー・ロス・ソーキン氏が行ったインタビューは、NBCニュースのYouTubeページに掲載された。
ビデオの 13 分 34 秒で、ソーキン氏はスレイマン氏に、ウェブからデータを取得する生成 AI の問題と、ソーキン氏の言葉を借りれば、これらのモデルが「AI 企業が本質的に世界の知的財産を盗んだかどうか」について尋ねました。
スレイマン氏の答えは、コンテンツ作成者が聞きたいものではないかもしれません。
すでに無料のインターネット上にあるコンテンツに関しては、90 年代以来、そのコンテンツの社会契約はフェアユースであるというものでした。 誰でもそれをコピーしたり、作り直したり、再現したりすることができます。 それが「フリーウェア」だというのがコンセンサスでした。 ウェブサイト、出版社、または報道機関が、他の人がそのコンテンツを見つけられるようにインデックスに登録する以外の理由で私をクロールしたりスキャンしたりしてはならないと明示する別のカテゴリがあります。 これはグレーゾーンであり、法廷で争われることになると思います。
スレイマン氏の返答は、マイクロソフト、そしておそらく他のAI企業が、インターネット上のほとんどすべてのものをモデルのトレーニングに使用できると信じており、これらの企業はそのコンテンツの作成者に補償する必要はないと考えているようだ。 この主張は、今後数か月、数年でさらに多くの訴訟につながる可能性があります。
#Microsoft #の告白 #インターネット上のすべてが #のトレーニングに使用されている