1744996652
2025-04-18 09:15:00
マドリード、18 ABR。 (Portaltic/EP) –
Wikimedia Foundationは、自動学習専用のコミュニティが利用できるようになった一連の構造化データを作成し、モデルのトレーニングでそれらを使用できるようにすることを決定しました。
人気のある「オンライン」百科事典であるウィキペディアを担当する組織は、最近、自動プログラムからのトラフィックの増加がコンテンツをダウンロードし、人工知能モデルのトレーニングでそれらを使用することについて警告しました。
これは彼に影響を与えていました 操作能力彼らは人間以外のトラフィックに対応するためにより多くの時間とリソースを費やさなければならなかったため、インフラストラクチャの使用コストとメンテナンスが大きくなることを意味していました。
現在、彼は、「モデルのトレーニング、機能の構築、自然言語処理チャネルのテストに」で使用できるように、Kaggyで無料でオープンで共有したウィキペディアの構造化データセットの作成を発表しました。 声明で。
このデータは、英語とフランス語でコンピューターを読み取ることができる形式で共有され、「要約、短い説明、情報価値のデータ値、明確にセグメント化されたアイテムの画像の画像」が含まれています。
#ウィキメディア財団はAIトレーニングの構造化データセットを共有しています