大きな写真を見る
NVIDIA CEO のジェンセン ファン氏は、1 月 5 日 (現地時間)、米国ネバダ州ラスベガスのフォンテーヌブロー ホテルで開催された NVIDIA CES 2026 Live で特別講演を行っています。聯合ニュース
CES 2026 のステージ上で Nvidia CEO のジェンスン・フアン氏の隣には、アヒルのように歩く 2 台のロボットがいました。同氏はロボットとアイコンタクトをとり会話をしながらプレゼンテーションを続け、ロボット業界の「ChatGPTの瞬間」が到来したと宣言した。
NVIDIA の発表は、AI が考える機械から動く機械に進化していることを示すものです。いわゆる「物理AI」の時代が到来しました。 Jensen Huang 氏は、現実世界を理解し、推論を行い、アクションを計画する物理 AI モデルの革新が、まったく新しいアプリケーションへの扉を開いてくれていると強調しました。
この新しい市場において、NVIDIA は、スマートフォン エコシステムにおける Android のような、不可欠な基盤プラットフォームになることを目指しています。 NVIDIA が明らかにしたロボットのエコシステムは非常に詳細です。ロボットに視覚、推論、計画能力を与える Cosmos シリーズのコアモデルとツールが、Hugging Face に公開されました。 Hugging Face は、AI モデルを共有、学習、配布するためのプラットフォームです。
これまでロボット工学に対する最大の障害は現実の厳しさでした。ロボットがケーブルの接続方法を学習中に故障した場合、数千ドル相当の部品が破損したり、人が怪我をしたりする可能性があります。 NVIDIA は、「Isaac Lab-Arena」でこの問題を解決しようとしています。このオープンソース シミュレーション フレームワークを使用すると、ロボットを仮想的に安全にテストし、無限にトレーニングできるため、現実世界でのトレーニングのコストとリスクが大幅に削減されます。
NVIDIA はまた、人型ロボットが物理世界で見て、理解し、行動できるようにする VLA (Vision-Language-Action) モデル「Isaac Groot (GR00T)」も発表しました。一般的なマルチモーダル AI はテキストや画像の理解と説明に限定されていますが、VLA モデルは理解した内容に基づいて物理的な「アクション」を直接作成します。
コスモスが物理世界の法則を理解して予測する環境インテリジェンスを提供する場合、グルートはコスモスが提供する理解に基づいて特定の行動を決定します。これにより、ロボットは、曖昧なコマンドを受け取った場合でも、常識と物理法則を使用して推論し、段階的な計画を立てることができます。これは、特定のタスクを繰り返すだけだった愚かな自動機械が、自ら判断を下す知的な存在へと進化し始めたことを意味します。
これらすべてのソフトウェアの野望をサポートしているのが、Nvidia のハードウェアです。 Blackwell ベースの Jetson T4000 は、ロボットの頭脳であるオンデバイス コンピューティングを担当します。このチップは 40 ~ 70 ワット (W) の電力で 1,200 テラフロップスの AI 計算を実行し、ロボットがクラウドに接続しなくても瞬時に判断して反応できるようにします。
将来、ロボット産業は未来の食品を超え、肉体労働の未来を再定義するでしょう。 NVIDIA の戦略は明らかです。ゴールドラッシュ時代にジーンズを販売したリーバイス社のように、ロボット革命の時代には「インテリジェンスインフラ」を販売する計画だ。 NVIDIA は、ロボット メーカーを開発の労力から解放するのではなく、独自のオペレーティング システムとチップセットなしではロボットを製造できない世界を夢見ています。すでに、Hugging Face ではロボット関連モデルのダウンロードが爆発的に増加しています。私たちは現在、生成型 AI の時代を過ぎ、「行動型 AI」の時代に入りつつあります。いつものように、革ジャンを着たジェンセン・ファンがその街角に立っています。
#칼럼 #ロボット革命への道に立つ革ジャンを着た男性