GPU の巨人は誇大宣伝とスケールを持っていますが、ハイパースケーラーではありません
価値が 3 兆ドルをわずかに上回るにもかかわらず、NVIDIA は神経質になっています。
世界で最も価値のある企業の 1 つであるこの GPU メーカーの過去 2 年間の急速な躍進は、岩だらけの基盤の上に築かれています。同社のチップは AI 革命の中心ですが、Nvidia が最も重要な顧客として依存しているハイパースケーラーも同様です。その最大のライバルたち。
アマゾン ウェブ サービス、マイクロソフト、グーグルはいずれも、コストを削減し独自の優位性を見つけようとして、独自の AI チップを開発しています。
同時に、これらのクラウド企業は、NVIDIA が販売する GPU をエンド顧客にレンタルすることで、より多くの収益を上げようとしています。チップ設計者は、クラウド プロバイダーが GPU の購入に費やす 1 ドルごとに、 , 彼らは4年間で5ドルを稼ぎます。
Nvidia は理論的には仲介業者を排除し、単純に自社のクラウド サービス上で GPU を提供し、すべての利益をかき集めることができます。しかし、規制上の懸念を除けば、それは最大の顧客を完全に遠ざけるリスクがあり、設立には数百億ドルの費用がかかる。
代わりに、同社は第 3 の選択肢、つまりクラウド内のクラウドを切り開こうとしている。
Nvidiaは昨年、他社のクラウドプラットフォーム上で提供されるサービス「DGX Cloud」を発表した。クラウド プロバイダーは Nvidia のサーバーをリースし、Nvidia が大型 GPU スーパーコンピューターを求める企業にマーケティングおよび販売できるクラウドとして展開します。
Google、Microsoft、Oracle は早い段階でこの提案に同意しましたが、AWS は 12 月まで持ちこたえ、最終的には折れました。ハイパースケーラーは正確な取り決めについては口を閉ざしており、自社のウェブサイトでサービスを宣伝する企業は存在しない。
むしろ、DGX Cloud は、NVIDIA が自社の GPU に対する切実な需要を利用してクラウド内に独自のスペースを切り開き、その市場での地位を利用してサービス収益の一部を獲得し、エンドユーザーとの直接的な関係を構築していると見なすこともできます。
「私はこれをトロイの木馬とはまったく考えていません」と DGX Cloud 責任者で元メタ インフラストラクチャ副社長の Alexis Bjorlin 氏は語ります。 DCD。
「これは深いパートナーシップなのです」と彼女はインタビューを通して繰り返し言った。 「私たちが行っていることは、クラウド サービス プロバイダーと緊密に連携していることです。 [CSPs]」
Nvidiaは2024年5月の収益報告書で、今後数年間でクラウドコンピューティングサービスに少なくとも90億ドルを費やすことを約束したと述べ、1月の45億ドルの約束から増加した。この数字には DGX Cloud も含まれており、取り組みが急速に拡大していることを示唆しています。
– エヌビディア
「DGX Cloud は、すべての CSP で Nvidia の最新テクノロジーにアクセスできるようにする機会です」と Bjorlin 氏は言います。 「全体から一歩下がってエンドユーザー エクスペリエンスについて考えるとき、それはフルスタック機能に関するものです。」
ビョーリン氏は、クラウド ビジネスを構築するという Nvidia の試みではなく、DGX Cloud のポイントは「エンドツーエンドのエクスペリエンスを提供することだった」と述べています。当社はサービス ソフトウェア スタックとしての完全なプラットフォームを備えており、AI ファウンドリ サービスを提供しています。」
さらに彼女は次のように付け加えました。「当社のお客様の多くは、ソフトウェアと AI/ML の専門知識をアプリケーションの開発に費やしたいと考えており、必ずしも基盤となるインフラストラクチャの管理(クラウド サービス プロバイダーの要素だと思われるかもしれません)を管理する必要はありませんが、実際には AI インフラ スタックです。そこが、DGX Cloud が独自に差別化されたものを提供するところだと思います。私たちは、顧客が旅行のどこにいても対応できるのです。」
顧客は「モデルの最適化、ランタイムの最適化などに関して当社が抱える Nvidia 社内の専門家全員にアクセスできるようになります」と彼女は言います。 「人々は、コストセンターではなく、収益を生み出す独自のアプリケーションの構築に集中できるように、もう少し消費しやすいものを探していると思います。」
これらの顧客は、基盤となるハードウェアが CSP データセンターで稼働しているにもかかわらず、Nvidia に来て、同社が設定した価格を支払います。
お客様は CSP の 1 つを非 DGX サービスに使用することが多いため、CSP は依然として重要です。 「通常、顧客は非常に自分の意見を持った人が来ます」とビョーリン氏は言います。 「彼らはどこかにデータを持っており、ここではデータグラビティが重要な側面です。はい、下り料金は下がったり下がったりしています。」
Bjorlin 氏は、顧客がどの CSP を使用すべきかを推奨する際に Nvidia がどれだけの情報を提供しているかについてはやや矛盾しています。「私たちはどのクラウドを使用するかを推奨しているわけではありませんが、パフォーマンスが最大化されると思われる場所を共有することはできます」と彼女は言います。 。
同社は各 CSP と協力して、独自の機能を備えたバージョンの DGX Cloud を構築しています。
「AWS では、AWS の EFA と協力することを発表しました。 [networking] そして彼らのニトロシステムです」とビョルリンは言います。同社は、DGX Cloud に 16,384 個の GPU を導入する予定であり、さらに AWS 経由でさらに数千個の GPU を直接導入する予定です。
「OCIとは [Oracle’s cloud]Blackwell 上の DGX Cloud のインスタンスでは、InfiniBand が使用されます。これは、彼らが過去に行ったことからの脱却です」と Bjorlin 氏は続けました。 「つまり、これは、この世代にとって最適なエクスペリエンスと機能は何かということを共同エンジニアリングした結果でした。
– セバスチャン・モス
「私たちは、ソリューションを全体的に最適化できるように、CSP のサービスであれ、実際のインフラストラクチャであれ、CSP に深く統合する機能を構築しています。」
ビョーリンは、そのような選択は「彼らの決断だ」と主張する。何も義務付けられていません。私たちは CSP のプラットフォームとは何かについて協力し、それを最適化することに喜んで取り組んでいます。彼らはエンドユーザー エクスペリエンスにどのように対処するかについて独自の選択を行っています。」
昨年、The Information は、Nvidia が DGX Cloud を実行するために独自のスペースをリースすることについて少なくとも 1 つのデータセンターと話し合ったと報じたが、Bjorlin 氏はコメントを控え、同社は CSP と「深いパートナーシップで協力することに重点を置いている」と述べた。 」
「私たちはあらゆる雲の上にあるプラットフォームです。私たちが提供しているのは、専門知識と活用、顧客のワークロードとエンドツーエンドのワークフローの理解、そして推奨事項の作成です」と彼女は言います。
これはAIの将来の発展にとって必要なことだと彼女は主張する。 「モデルは変わる可能性があります。複数の専門家が混在する環境に移行すると、ネットワークにさまざまなストレスがかかり、ワークロードのパフォーマンスが変化します。
「DGX Cloud は、AI が進化する先の最も広範なセットを実際に包含するものであり、それに向けて設計していることを確認し、最終的には Nvidia GPU がこれらの AI ワークロードの最終的な着地点となるようにします。」
クラウドとハイブリッド チャネルの詳細
#Nvidia #の #DGX #クラウドのバランス調整措置