日本語版
最新ニュース
世界

OpenAI は大規模な多言語 AI データセットのリリースで世界的な言語格差に取り組む

業界をリードする AI に関する最新情報や独占コンテンツを入手するには、毎日および毎週のニュースレターにご登録ください。 もっと詳しく知る OpenAIは、アラビア語、ドイツ語、スワヒリ語、ベンガル語、ヨルバ語を含む14の言語にわたる言語モデルのパフォーマンスを評価する多言語データセットを公開し、人工知能の世界的な普及に向けて大きな一歩を踏み出しました。 同社は、 多言語大規模マルチタスク言語理解 (MMMLU) データセット オープンデータプラットフォームHugging Faceで公開されたこの新しい評価は、人気の 大規模マルチタスク言語理解 (MMLU) ベンチマークは、数学から法律、コンピューターサイエンスまで57の分野にわたるAIシステムの知識を英語のみでテストする試験です。 OpenAI は、AI トレーニング データ用のリソースが限られている言語も含め、多様な言語を新しい多言語評価に組み込むことで、多言語 AI 機能の新たなベンチマークを設定しました。このベンチマークにより、テクノロジーへのより公平なグローバル アクセスが実現する可能性があります。AI 業界は、世界中の何百万人もの人々が話す言語を理解できる言語モデルを開発できないことで批判に直面しています。 OpenAIが多言語AIを評価するための世界的ベンチマークを提供 MMMLUデータセットは、世界中のユーザーと関わることができるAIシステムに対するニーズの高まりを反映し、多様な言語環境でAIモデルが機能することに挑戦しています。企業や政府がAI主導のソリューションを導入するにつれて、さまざまな言語でテキストを理解して生成できるモデルに対する需要が高まっています。 複数の言語 より切迫したものとなっている。 最近まで、AI研究は 主に英語 広く話されている言語は少数で、リソースの少ない言語の多くは取り残されています。スワヒリ語やヨルバ語など、数百万人が話しているにもかかわらず AI 研究では無視されがちな言語を含めるという OpenAI の決定は、より包括的な AI テクノロジーへの移行を示しています。この動きは、言語の壁が従来大きな課題となっていた新興市場で AI ソリューションを展開しようとしている企業にとって特に重要です。 人間による翻訳が多言語AIの精度の基準を引き上げる…

OpenAI は大規模な多言語 AI データセットのリリースで世界的な言語格差に取り組む

1727139084
2024-09-24 00:33:00

業界をリードする AI に関する最新情報や独占コンテンツを入手するには、毎日および毎週のニュースレターにご登録ください。 もっと詳しく知る

OpenAIは、アラビア語、ドイツ語、スワヒリ語、ベンガル語、ヨルバ語を含む14の言語にわたる言語モデルのパフォーマンスを評価する多言語データセットを公開し、人工知能の世界的な普及に向けて大きな一歩を踏み出しました。

同社は、 多言語大規模マルチタスク言語理解 (MMMLU) データセット オープンデータプラットフォームHugging Faceで公開されたこの新しい評価は、人気の 大規模マルチタスク言語理解 (MMLU) ベンチマークは、数学から法律、コンピューターサイエンスまで57の分野にわたるAIシステムの知識を英語のみでテストする試験です。

OpenAI は、AI トレーニング データ用のリソースが限られている言語も含め、多様な言語を新しい多言語評価に組み込むことで、多言語 AI 機能の新たなベンチマークを設定しました。このベンチマークにより、テクノロジーへのより公平なグローバル アクセスが実現する可能性があります。AI 業界は、世界中の何百万人もの人々が話す言語を理解できる言語モデルを開発できないことで批判に直面しています。

OpenAIが多言語AIを評価するための世界的ベンチマークを提供

MMMLUデータセットは、世界中のユーザーと関わることができるAIシステムに対するニーズの高まりを反映し、多様な言語環境でAIモデルが機能することに挑戦しています。企業や政府がAI主導のソリューションを導入するにつれて、さまざまな言語でテキストを理解して生成できるモデルに対する需要が高まっています。 複数の言語 より切迫したものとなっている。

最近まで、AI研究は 主に英語 広く話されている言語は少数で、リソースの少ない言語の多くは取り残されています。スワヒリ語やヨルバ語など、数百万人が話しているにもかかわらず AI 研究では無視されがちな言語を含めるという OpenAI の決定は、より包括的な AI テクノロジーへの移行を示しています。この動きは、言語の壁が従来大きな課題となっていた新興市場で AI ソリューションを展開しようとしている企業にとって特に重要です。

人間による翻訳が多言語AIの精度の基準を引き上げる

OpenAIはプロフェッショナル 人間の翻訳者 MMMLUデータセットを作成するために、OpenAIは人間の専門知識に頼ることで、機械翻訳に依存する同等のデータセットよりも高い精度を確保しています。自動翻訳ツールは、特にトレーニング用のリソースが少ない言語では、微妙なエラーを導入することがよくあります。OpenAIは、人間の専門知識に頼ることで、データセットが複数の言語でAIモデルを評価するためのより信頼性の高い基盤を提供することを保証します。

この決定は、精度が譲れない業界にとって非常に重要です。医療、法律、金融などの分野では、わずかな翻訳エラーでも深刻な影響を及ぼす可能性があります。OpenAI は翻訳の品質に重点を置いており、言語や文化の境界を越えて AI システムが確実に機能することを求める企業にとって、MMMLU データセットは重要なツールとして位置付けられています。

Hugging Faceとの提携により、多言語AIデータへのオープンアクセスが促進される

OpenAI は、機械学習モデルとデータセットを共有するための人気のプラットフォームである Hugging Face で MMMLU データセットを公開することで、より広範な AI 研究コミュニティと関わりを持っています。Hugging Face はオープンソース AI ツールの定番の目的地となっており、MMMLU データセットの追加は、AI 研究におけるオープン アクセスの推進に対する OpenAI の取り組みを示しています。

しかし、今回の発表は、OpenAI がオープン性へのアプローチに関して厳しい監視に直面している時期に行われた。 批判が高まっている 最近数か月、特に 共同創業者イーロン・マスクは、同社がオープンソースの非営利組織であるという本来の使命から逸脱していると非難している。 マスク氏の訴訟今年初めに提出された訴訟では、OpenAIの営利活動への転換、特にマイクロソフトとの提携は同社の設立理念に反していると主張している。

それにもかかわらず、OpenAIは現在の戦略を擁護し、「オープンアクセスオープンソースではなく、” です。このフレームワークでは、OpenAI は、最も高度なモデルの内部動作を必ずしも共有することなく、その技術への幅広いアクセスを提供することを目指しています。MMMLU データセットのリリースはこの哲学に適合しており、独自のモデルに対する制御を維持しながら、研究コミュニティに強力なツールを提供します。

OpenAI アカデミー: 新興市場における AI へのアクセスの拡大

MMMLUデータセットのリリースに加えて、OpenAIは、 OpenAIアカデミーMMMLU データセットと同日に発表されたこのアカデミーは、特に低所得国および中所得国のコミュニティにおける重大な問題に AI を活用して取り組んでいる開発者やミッション主導の組織に投資することを目的としています。

アカデミーはトレーニング、技術指導、 100万ドルのAPIクレジット 地元の AI 人材が最先端のリソースにアクセスできるようにするためです。OpenAI は、地域特有の社会的、経済的課題を理解している開発者をサポートすることで、コミュニティが地域のニーズに合わせた AI アプリケーションを構築できるようにしたいと考えています。

この取り組みは、高度な AI ツールと教育を多様なグローバル コミュニティに提供するという OpenAI の目標を強調することで、MMMLU データセットを補完します。MMMLU データセットとアカデミーはどちらも、AI 開発が全人類、特に最新の AI の進歩によって従来十分なサービスを受けられなかったコミュニティに利益をもたらすようにするという OpenAI の長期戦略を反映しています。

多言語AIが企業に競争上の優位性をもたらす

企業にとって、MMMLUデータセットは、自社のAIシステムをベンチマークする機会を提供します。 グローバルな文脈企業が国際市場に進出するにつれ、複数の言語を理解する AI ソリューションを展開する能力が重要になります。顧客サービス、コンテンツ モデレーション、データ分析など、さまざまな言語で優れたパフォーマンスを発揮する AI システムは、コミュニケーションの摩擦を減らし、ユーザー エクスペリエンスを向上させることで、競争上の優位性を提供できます。

データセットは専門分野と学術分野に重点を置いているため、企業にとってさらに価値が高まります。法律、教育、研究分野の企業は、MMMLU データセットを使用して、専門分野での AI モデルのパフォーマンスをテストし、システムがこれらの分野で求められる高い基準を満たしていることを確認できます。AI が進化し続けるにつれて、複数の言語で複雑なドメイン固有のタスクを処理できる能力は、グローバルな舞台で競争する企業にとって重要な差別化要因になります。

多言語の未来: MMMLU データセットが AI に意味するもの

MMMLU データセットのリリースは、AI 業界に永続的な影響を及ぼす可能性があります。より多くの企業や研究者がこの多言語ベンチマークに対してモデルをテストし始めるにつれて、言語間でシームレスに動作できる AI システムの需要は高まるばかりです。これにより、言語処理における新たなイノベーションが生まれ、従来テクノロジーが十分に活用されていなかった世界各地で AI ソリューションの採用が拡大する可能性があります。

OpenAI にとって、MMMLU データセットは課題であると同時にチャンスでもあります。一方で、同社は多言語 AI のリーダーとしての地位を確立し、現在の AI 環境における重大なギャップに対処するツールを提供しています。他方、OpenAI のオープン性に対する姿勢は進化し続けており、公共の利益と私的利益の間の緊張関係をうまく乗り越えていく中で、今後も精査され続けるでしょう。

AI が世界経済にますます統合されるにつれて、企業も政府も、これらのテクノロジーの倫理的および実際的な影響に取り組む必要が出てくるでしょう。OpenAI による MMMLU データセットの公開は正しい方向への一歩ですが、AI 革命のどこまでがすべての人に公開されるのかという重要な疑問も生じています。

VBデイリー

最新情報を入手しましょう! 毎日最新ニュースをメールでお届けします

ご登録ありがとうございます。詳しくはこちら VBニュースレターはこちら

エラーが発生しました。

#OpenAI #は大規模な多言語 #データセットのリリースで世界的な言語格差に取り組む

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。