1732526859
2024-11-25 07:35:00
人工知能 (AI) 業界が成熟し続けるにつれて、モデルをトレーニングしてサービスを提供するための堅牢なインフラストラクチャの開発が必要となり、データのストレージと管理に大きな影響を与えます。これは、生成されるデータの量、そして最も重要なことに、この洞察をどこにどのように保存するかに重大な影響を及ぼします。
AI ツールの継続的な成長と開発によりデータ要件が急激に増加するにつれ、このデータを効率的に管理する機能が重要になってきています。したがって、これらのシステムをサポートするために必要なストレージ インフラストラクチャは、AI アプリケーションと機能の急速な進歩と並行して拡張できる必要があります。
AI が新しいデータを作成し、既存のデータの価値をさらに高めることで、データ生成の増加がストレージ ニーズの拡大につながるというサイクルがすぐに生まれます。これによりさらなるデータ生成が促進され、AI 開発を前進させる「有益な AI データ サイクル」が形成されます。 AI の可能性を最大限に活用するには、組織はこのサイクルを把握するだけでなく、そのサイクルがインフラストラクチャとリソース管理に与える影響を十分に理解する必要があります。
Peter Hayles 氏、Western Digital、HDD プロダクト マーケティング マネージャー
6 段階の AI データ サイクル
AI データ サイクルは、データの処理と保存を合理化するために設計された 6 段階のフレームワークで構成されています。最初の段階では、既存の生データとストレージの収集に重点が置かれます。ここでのデータはさまざまなソースから収集および保存されており、収集されたデータの品質と多様性の分析が次の段階の基礎を築くために重要です。サイクルのこの段階では、ドライブあたりの容量が最大で、ビットあたりのコストが最低であるため、キャパシティ エンタープライズ ハードディスク ドライブ (eHDD) が推奨されます。
次の段階では、データを取り込むために準備し、前の段階での評価をトレーニング目的で管理、準備、変換します。この段階に対応するために、データセンターは、高速データレイクなどのアップグレードされたストレージ インフラストラクチャを適用して、データの準備と取り込みをサポートしています。ここでは、既存の HDD ストレージを強化したり、新しいオールフラッシュ ストレージ システムを作成したりするために、大容量 SSD が必要です。これにより、整理され準備されたデータに迅速にアクセスできるようになります。
次に、トレーニング データを使用して正確な予測を行うための AI モデルのトレーニングの次の段階が始まります。このフェーズは通常、高性能スーパーコンピューターで発生し、可能な限り効率的に動作するには、特定の高性能ストレージ ソリューションが必要です。ここでは、この段階の特定のニーズを満たすために高帯域幅のフラッシュ ストレージと低遅延の強化された eSSD が作成され、必要な速度と精度を提供します。
次に、トレーニング後の推論とプロンプトの段階では、AI モデルのユーザーフレンドリーなインターフェイスの作成に焦点を当てます。この段階では、アプリケーション プログラミング インターフェイス (API)、ダッシュボード、およびコンテキストと特定のデータをエンドユーザー プロンプトと組み合わせるツールの使用が組み込まれています。そうすれば、現在のシステムを交換する必要なく、AI モデルがインターネットとクライアント アプリケーションに統合されます。これは、新しい AI コンピューティングと並行して現在のシステムを維持するには、さらなるストレージが必要になることを意味します。
ここでは、コンピューターの AI アップグレードには大容量で高速な SSD が不可欠であり、スマートフォンや IoT システムでは実世界のアプリケーションでシームレスな機能を維持するために、より大容量の組み込みフラッシュ デバイスが必要です。
AI 推論エンジンの段階が続き、トレーニングされたモデルが実稼働環境に配置され、新しいデータの検査が実行され、新しいコンテンツが生成され、またはリアルタイムの予測が提供されます。この段階では、迅速かつ正確な AI 応答を実現するには、エンジンの効率レベルが非常に重要です。したがって、包括的なデータ分析を確実に行うには、優れたストレージ パフォーマンスが不可欠です。この段階をサポートするには、大容量 SSD をストリーミングに使用したり、スケールや応答時間のニーズに基づいて推論サーバーにデータをモデル化したりすることができます。また、高性能 SSD をキャッシュに使用することもできます。
最終段階では、AI モデルによって生成された洞察を使用して新しいコンテンツが作成され、保存されます。この段階では、将来のモデルのトレーニングと分析に備えてデータの価値を継続的に強化することで、データ サイクルが完了します。生成されたコンテンツは、データセンターのアーカイブ目的ではエンタープライズ ハード ドライブに保存され、AI エッジ デバイスでは大容量 SSD と組み込みフラッシュ デバイスの両方に保存され、将来の分析にすぐに利用できるようになります。
自立的なデータ生成サイクル
AI データ サイクルの 6 つの段階を十分に理解し、各段階をサポートする適切なストレージ ツールを採用することで、企業は AI テクノロジーを効果的に維持し、社内業務を合理化し、AI 投資のメリットを最大化することができます。
今日の AI アプリケーションはデータを使用して、テキスト、ビデオ、画像、その他のさまざまな形の興味深いコンテンツを生成します。このデータの消費と生成の継続的なループにより、大規模な AI データセットを管理し、複雑なデータを効率的にリファクタリングしてさらなるイノベーションを推進するための、パフォーマンス重視のスケーラブルなストレージ テクノロジーの必要性が加速しています。
業務全体にわたる AI の役割がさらに普及し、不可欠になるにつれて、適切なストレージ ソリューションに対する需要は大幅に増加すると考えられます。その結果、データへのアクセス、AI モデルの効率と精度、そしてより大規模で高品質なデータセットもますます重要になるでしょう。さらに、AI がほぼすべての業界に組み込まれるようになるにつれ、パートナーや顧客は、AI データ サイクルのあらゆる段階で適切なソリューションが存在するように、ストレージ コンポーネント プロバイダーが自社の製品をカスタマイズすることを期待できます。
最高のデータ復旧サービスを特集しました。
この記事は、TechRadarPro の Expert Insights チャンネルの一部として作成され、今日のテクノロジー業界で最も優れた頭脳を特集しています。ここで表明されている見解は著者の見解であり、必ずしも TechRadarPro または Future plc の見解ではありません。貢献に興味がある場合は、ここで詳細を確認してください。 https://www.techradar.com/news/submit-your-story-to-techradar-pro
#データ #サイクルにおいてストレージが果たす役割