日本語版
最新ニュース
科学&テクノロジー

OpenAI が間違った方法で大人気の子育てフォーラムを台無しにした

子育てに関するどんな話題でも、想像できる限り、長年にわたり絶大な人気を誇るマムズネットにその投稿があるはずです。 論争を巻き起こす イギリスを拠点とする母親のための子育てフォーラム。20年以上の歴史を持つマムズネットは、汚れたおむつや怠け者の夫などの話題について、熱心なユーザーベースによって書かれた60億語以上のアーカイブを蓄積してきました。( イルカについての狂った暴言。今春、マムズネットはAI企業が自社のデータをスクレイピングしていることを発見した後、この分野の大手企業数社とライセンス契約を結ぼうと決めたと述べている。その中には、マムズネットが最初に接触したときに契約を検討する意向を示したOpenAIも含まれていた。OpenAIとの交渉が決裂した後、マムズネットは7月に、 法的措置を取る。マムズネットによると、初期の話し合いの際、OpenAIの戦略的パートナーシップのリーダーが同社に対し、10億語を超えるデータセットがこのAIの巨人に興味を持っていると伝えた。マムズネットの幹部は興奮した。「彼らとのやり取りにかなりの時間を費やしました」とマムズネットの創設者兼CEOのジャスティン・ロバーツはWIREDに語った。「いくつかのNDAに署名する必要があり、彼らは私たちに多くの情報を要求しました」しかし、WIREDが確認した電子メールのやり取りによると、1か月以上経ってOpenAIはMumsnetに対し、その時点では提携にはもう興味がないと伝えた。理由を尋ねられたOpenAIのスタッフは、Mumsnetの60億語のデータセットはライセンス契約を正当化するには小さすぎると述べたとロバーツは言う。彼らはまた、OpenAIが主に関心を持っているのは、一般の人々がオンラインでアクセスできない大規模なデータセットであり、幅広い人間の経験を捉えたデータセットを求めていると述べた。WIRED からコメントを求められた同社も、この考えに同調した。「私たちは、人間社会を反映する大規模なデータセットに関するパートナーシップを追求しており、公開情報のみに関するパートナーシップを追求するわけではありません」と OpenAI の広報担当者 Kayla Wood 氏は言う。「私たちは出版社やクリエイターの選択をサポートし、検索結果でサイトやコンテンツが AI とどのように連携するか、また生成 AI 基盤モデルをトレーニングする方法について、好みを表明する方法を提供しています。」ロバーツ氏は、この展開に「イライラした」と語る。彼女は、OpenAI が当初 Mumsnet に特に興味を示したのは、プラットフォームに女性が書いたコンテンツが多数含まれていたためだと振り返る。「非常に質の高い会話データです」と彼女は言う。「会話の 90% が女性によるもので、これは非常に珍しいことです」OpenAIは過去1年間にメディアやプラットフォームと様々なデータライセンス契約を締結し、 ヴォックスメディア、 の 大西洋、 アクセル・スプリンガー、 時間、WIREDの親会社 コンデナスト、そしてRedditのようなユーザー生成コンテンツが満載のプラットフォームもそうだ。(WordPress.comとTumblrの所有者であるAutomatticも、今年初めにライセンス交渉中と言われていた。)これらの契約の詳細は明らかにされていないため、それぞれのコンテンツの規模がどの程度なのかは不明だ。WIREDがOpenAIに商用ライセンスの対象となるデータセットの規模について質問したところ、同社はその情報提供を拒否した。しかし、広報担当のケイラ・ウッド氏は、同社と出版社との提携は「同社のコンテンツを当社製品に表示し、トラフィックを誘導することに重点を置いている」と強調している。 #OpenAI #が間違った方法で大人気の子育てフォーラムを台無しにした

OpenAI が間違った方法で大人気の子育てフォーラムを台無しにした

1726537495
2024-09-16 11:30:00

子育てに関するどんな話題でも、想像できる限り、長年にわたり絶大な人気を誇るマムズネットにその投稿があるはずです。 論争を巻き起こす イギリスを拠点とする母親のための子育てフォーラム。20年以上の歴史を持つマムズネットは、汚れたおむつや怠け者の夫などの話題について、熱心なユーザーベースによって書かれた60億語以上のアーカイブを蓄積してきました。( イルカについての狂った暴言

今春、マムズネットはAI企業が自社のデータをスクレイピングしていることを発見した後、この分野の大手企業数社とライセンス契約を結ぼうと決めたと述べている。その中には、マムズネットが最初に接触したときに契約を検討する意向を示したOpenAIも含まれていた。OpenAIとの交渉が決裂した後、マムズネットは7月に、 法的措置を取る

マムズネットによると、初期の話し合いの際、OpenAIの戦略的パートナーシップのリーダーが同社に対し、10億語を超えるデータセットがこのAIの巨人に興味を持っていると伝えた。マムズネットの幹部は興奮した。「彼らとのやり取りにかなりの時間を費やしました」とマムズネットの創設者兼CEOのジャスティン・ロバーツはWIREDに語った。「いくつかのNDAに署名する必要があり、彼らは私たちに多くの情報を要求しました」

しかし、WIREDが確認した電子メールのやり取りによると、1か月以上経ってOpenAIはMumsnetに対し、その時点では提携にはもう興味がないと伝えた。理由を尋ねられたOpenAIのスタッフは、Mumsnetの60億語のデータセットはライセンス契約を正当化するには小さすぎると述べたとロバーツは言う。彼らはまた、OpenAIが主に関心を持っているのは、一般の人々がオンラインでアクセスできない大規模なデータセットであり、幅広い人間の経験を捉えたデータセットを求めていると述べた。

WIRED からコメントを求められた同社も、この考えに同調した。「私たちは、人間社会を反映する大規模なデータセットに関するパートナーシップを追求しており、公開情報のみに関するパートナーシップを追求するわけではありません」と OpenAI の広報担当者 Kayla Wood 氏は言う。「私たちは出版社やクリエイターの選択をサポートし、検索結果でサイトやコンテンツが AI とどのように連携するか、また生成 AI 基盤モデルをトレーニングする方法について、好みを表明する方法を提供しています。」

ロバーツ氏は、この展開に「イライラした」と語る。彼女は、OpenAI が当初 Mumsnet に特に興味を示したのは、プラットフォームに女性が書いたコンテンツが多数含まれていたためだと振り返る。「非常に質の高い会話データです」と彼女は言う。「会話の 90% が女性によるもので、これは非常に珍しいことです」

OpenAIは過去1年間にメディアやプラットフォームと様々なデータライセンス契約を締結し、 ヴォックスメディア大西洋アクセル・スプリンガー時間、WIREDの親会社 コンデナスト、そしてRedditのようなユーザー生成コンテンツが満載のプラットフォームもそうだ。(WordPress.comとTumblrの所有者であるAutomatticも、今年初めにライセンス交渉中と言われていた。)これらの契約の詳細は明らかにされていないため、それぞれのコンテンツの規模がどの程度なのかは不明だ。

WIREDがOpenAIに商用ライセンスの対象となるデータセットの規模について質問したところ、同社はその情報提供を拒否した。しかし、広報担当のケイラ・ウッド氏は、同社と出版社との提携は「同社のコンテンツを当社製品に表示し、トラフィックを誘導することに重点を置いている」と強調している。

#OpenAI #が間違った方法で大人気の子育てフォーラムを台無しにした

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。