1744677293
2025-04-14 23:00:00
それはセブアノです:主にフィリピン南部で話されている言語。
それはまた、ウィキペディアが創業以来取り組んできた議論をむき出しにし、人工知能(AI)がこれまで以上に差し迫っています。
lsjbotが記事を「書く」方法
ウィキペディアの一部を自動化するプログラムは、Webサイト自体とほぼ同じくらい古いプログラムです。
LSJBOTクリエーターSverker Johansson。 (供給:ローリー・ヨハンソン)
「私は考え始めました:私はそれができる。私はもっとうまくやれる」と彼は言う。
「コア言語モデルは数百の文のテンプレートであり、その後、ボットはどの情報が利用可能かを確認します」とヨハンソン博士は言います。
何千ページものページをウィキペディアに寄付するようになったのはなぜですか?
ヨハンソン博士は、彼の妻の母国語であるため、セブアノに集中することを選択しました。彼女は彼が文のテンプレートを書くのを手伝いました。
「私は彼女の言語にはあまり堪能ではありませんが、とにかく助けたいと思っていました。これは私ができる方法だと思いました」と彼は言います。
彼はまた、フィリピンの別の言語、そして彼の故郷のスウェーデン語でボットを走らせました。
LSJBOT周辺の論争
LSJBOTは、フィリピンのウィキペディアコミュニティに大きな波紋を引き起こしましたが、それらすべてが良いわけではありません。
ウィキペディアンと呼ばれるウィキペディアを作成して維持するボランティアは、不完全な翻訳のおかげで、セブアノ言語のページの多くが文法的で、時には事実上の誤りを持っていることを発見しました。
アービン・スト。インドネシアで開催された2025年のウィキソース会議でのトマス。 (ウィキメディアコモンズ:メモプロダクション、 CC by-sa 4.0))
アービン・スト。そのコミュニティのメンバーであるトマスは、地元のウィキペディアンの小さなグループが、DRとの仕事を含め、セブアノのページの品質を改善しようとしていると言います ヨハンソンはlsjbotです。
「残念ながら、ボランティアの編集者だけではできないほど多くのことがあります」と、他のフィリピン言語のウィキペディアと協力しているトマス氏は言います。
非セブアノフィリピンのウィキペディアスも編集したジョシュリムは、自動化されたボットがLSJBOTよりずっと前に評判の問題を引き起こしたと言います。
「それがどれほど恥ずかしいのか知っていますか?」リム氏は言います。
それにもかかわらず、彼はヨハンソン博士の意図が良いと信じています。
「彼がしたことはウィキペディアの奉仕において正しかったと思う」とリム氏は言う。
ポーランドで開催された2024年のウィキマニア会議でのジョシュ・リム。 (ウィキメディアコモンズ:ニコロカランティ、 CC by-sa 4.0))
彼はまた、ウィキペディアンはすべきではないと考えています ボットと自動化ツールを完全に拒否します。
「変化を評価して受け入れるために、ウィキペディアンの側で、この能力、またはその欠如について語っています。」
一方、スウェーデンのウィキペディアコミュニティは、LSJBOTの使用に最初に同意し、その後戻ってきました。
LSJBOTは2021年以来、ほとんど活動的ではありません。ヨハンソン博士は、その使用に関する議論はそれを引退させる彼の理由の一部であると言います。
ネイティブ言語は切り下げられました
ヨハンソン博士がLSJBOTを引退したもう1つの理由は、それが彼が望んでいた目的の1つを達成していなかったからです。読者と編集者の「クリティカルマス」をセブアノウィキペディアに持ち込み、より豊かな百科事典を触発します。
によると ウィキメディア統計、セブアノウィキペディアは現在、毎月フィリピンから数万ページのビューを繰り広げています。
一方、英語のウィキペディアは、1か月あたり1億人以上のフィリピン人の視聴者を獲得しています。
リム氏は、これは英語以外のウィキペディアのより広い問題だと言います。たとえば、Tagalog Wikipediaは、1か月あたり約200万人の地元のヒットを受け取ります。
「それは単なる一般的な植民地時代の経験です。私たちの母国語は切り下げられています」とリム氏は言います。
「それは、これらの言語で利用可能な情報の量に影響を与えます。」
この「切り下げ」は、インターネット全体に表示されます。たとえば、Google Translateの初期バージョンは、多くの科学用語を翻訳しました フィリピン人の冒とくに、どうやらそれを正確に行うためのより良いデータが不足しているようです。
しかし、リム氏は、「言語の誇りの上昇」がより多くのフィリピン人を引き付けて母国語を使用していると言い、ウィキペディアのようなサイトが役立つと考えています。
「ウィキペディアは、人々が自分自身を表現できるようにし、母国語で複雑な思考を表現できるという解決策の一部です。」
セブアノウィキペディアには他の用途がありました。時には珍しいコーナーからです。
ヘザー・フォード、シドニー大学の通信学校の准教授。 (供給:エヴァンジェリンアグアス)
シドニー工科大学の研究者であるヘザー・フォードは、オーストラリアが英語のウィキペディアにどのように描かれているかを調査するチームの一員です。
昨年、チームはセブアノウィキペディアを比較ポイントとして使用して、オーストラリアの場所がどのように描かれたかを確認しました。
彼らは、セブアノのデータベース生成エントリと比較して、英語のウィキペディア オーストラリアの都市にもっと焦点を合わせ、自然の特徴にはあまり焦点を当てていません。
「私たちはあなたが見ている百科事典が重要であることを本当に強調したかったのです [as to the information presented]フォード博士は言う。
生成AIの時代のウィキペディア
ヨハンソン博士は、彼のボットと、ChatGptやMicrosoftのCopilotなどの生成AIモデルの間に明確な境界線を描きます。
「[Lsjbot] 新しいテキストは作成されません。既存の情報を既存のテンプレートにパッケージ化するだけです。他には何もできません。それは何も発明しません」と彼は言います。
一方、AIの大手言語モデルは物事を発明します。信頼できる情報を作成するのではなく、説得力があるように聞こえるように設計されています。
「それはフィクションだから、あなたが事実情報を望むなら、彼らは非常に危険です」とヨハンソン博士は言います。
これは、フォード博士とリム氏の両方に同意する区別です。
「翻訳の質について議論することができます [of lsjbot]、しかし、根本的な事実はそれにもかかわらず真実です。生成AIでも同じことを言うことはできません」とリム氏は言います。
Openaiの最新のGPTの精度は疑問視されました
彼は、AIに生成されたテキストを含めるという決定は、その正確性を確認できる人間の編集者と一緒に休むべきであることを強調しています。
「私は一般的に、ウィキペディアンがこれについてはるかに思慮深いことを信じています。私たちは、生成的なAIが言っていること、フック、ライン、シンカーを信じているだけではありません」とリム氏は言います。
研究者は調べようとしているが、ウィキペディアのどれだけがAIが生成されたかを正確に伝えるのは難しい。最近のプレリントの1つは、百科事典が今である可能性があることを示唆しています 1つまたは2パーセント ai、別の人は同じくらい提案しました 5%。
この割合が成長した場合、フォード博士は、LSJBOTがセブアノで行ったように、ウィキペディアのすべてのバージョンを維持するには大きすぎると恐れています。
「ウィキペディアンが百科事典に何があるべきか、何がすべきではないかについて決定を下すとき、それは注目の問題だけではない」と彼女は言う。
「それも労働の問題でもあります。」
ウィキペディアは大規模な言語モデルをトレーニングするために使用されるため、AIに生成された材料を追加すると、モデルの崩壊のリスクもあります。
AIモデルによって犯された間違いは、エラーを排除し、将来のAIモデルに訓練して組み込まれるために使用されます。または、リム氏が要約しているように:ゴミを入れると、ゴミ。
自動化は、ウィキペディアにとって新しい概念ではありません。しかし、生成的AIは、新しいリスクと利点をもたらします。
リム氏は、サイトが信頼できるリソースとしてのステータスを維持するために、ウィキペディアンがこれらの質問に早く対処する必要があると言います。
「私たちは信頼できると信じていますが、私たちは誤りがちであり、事実で神を演じるべきではないと信じています。」
#ウィキペディアの最大の非英語版はボットによって作成されました生成AIは新しい問題を提起します