1728120375
2024-10-05 09:00:00
AI はほとんど写っていない画像: Andriy Onufriyenko (Getty Images)
構造化合成データの先駆者である Mostly AI が、 合成テキスト機能これにより、Databricks やアマゾン ウェブ サービス (AMZN) を含むフォーチュン 500 企業は、ユーザーのプライバシーを損なうことなく、大規模な言語モデル (LLM) をトレーニングおよび微調整するための「膨大な量の独自テキスト」にアクセスできるようになったと同紙は述べています。
Mostly AI プラットフォームでは、ユーザーは電子メールやカスタマー サポート通話のトランスクリプトなどの元のテキスト データをアップロードし、Hugging Face からオープンソース言語モデルを選択して合成データを生成できます。元のデータは、Mostly AI プラットフォーム上で LLM を微調整するために使用され、ダウンロードまたはデータベースに保存できる合成テキストが生成されます。
「現在、モデルが公開データソースを使い果たし、収益が減少しているため、AIトレーニングは頭打ちになっている」とMostly AIの最高経営責任者、トビアス・ハン氏は述べた。 声明。 「現在使用されている残りの公的データよりもはるかに大きな価値と可能性をもたらす高品質の独自データを活用するには、グローバル企業は思い切って構造化合成データと非構造化合成データの両方を活用して、今後の生成 AI ソリューションを安全にトレーニングして展開する必要があります。 」
#今週は新しい #が発表されます