日本語版
最新ニュース
科学&テクノロジー

Silicon ValleyがAIについて信じていることをDeepseekが変えることができる理由

株式市場を通じて衝撃波を送り、シリコンバレーの巨人を吸い上げ、息をのむような息を切らしている人工知能のブレークスルーは、アメリカの技術的優位性の終わりについて到着しました。 22ページの紙、先週、Deepseekと呼ばれる粗末な中国のAIの新興企業によってリリースされましたが、すぐにアラームベルを引き起こしませんでした。研究者が論文の主張とそれが説明したことの意味を消化するのに数日かかりました。同社は、DeepSeek-R1と呼ばれる新しいAIモデルを作成しました。これは、控えめな数のAIチップを使用して、大手アメリカのAIモデルのパフォーマンスをわずかなコストで一致させたと主張した研究チームによって構築されました。Deepseekは、巧妙なエンジニアリングを使用して、生のコンピューティング馬力を代用することでこれを行ったと述べました。そして、それは中国でそれをやった。多くの専門家が世界的なAIレースで遠い2位になっていると考えていた国。一部の業界のウォッチャーは、最初はDeepseekの不信感に反応しました。確かに、彼らは、DeepseekがR1の結果を達成するためにだまされたか、モデルをより印象的に見せるために数字を倒したと考えていました。たぶん、中国政府は、アメリカのAI支配の物語を損なうためにプロパガンダを促進していたのかもしれません。たぶんdeepseekはそうでした 違法なnvidia H100チップの隠し場所を隠す、米国の輸出管理の下で禁止され、それについて嘘をついています。たぶん、R1は実際には、実際の進歩の方法であまり表していないアメリカのAIモデルの巧妙な再皮でした。最終的に、より多くの人々がDeepSeek-R1の詳細を掘り下げるにつれて - ほとんどの主要なAIモデルとは異なり、オープンソースソフトウェアとしてリリースされ、部外者がその内部の仕組みをより密接に調べることができます - 彼らの懐疑論は心配に変わりました。そして先週遅く、多くのアメリカ人がDeepseekのモデルを自分で使用し始め、DeepseekモバイルアプリがAppleのApp Storeでナンバーワンのスポットにヒットしたとき、それは本格的なパニックに陥りました。私は、過去数日間にわたって見た中で最も劇的なテイクに懐疑的です。 1つのシリコンバレーの投資家、そのDeepseekは、アメリカの技術産業を破壊するための中国政府による精巧な陰謀です。また、会社の靴ひもの予算がひどく誇張されていること、またはそれが明らかにしていない方法でアメリカのAI企業が行った進歩に貯金したことはもっともらしいと思います。しかし、DeepseekのR1ブレークスルーは本物だったと思います。業界のインサイダーとの会話と、1週間分の専門家が紙の調査結果を自分自身のためにテストし、テストしたことに基づいて、アメリカの技術産業が行ってきたいくつかの主要な仮定に疑問を投げかけているようです。1つ目は、最先端のAIモデルを構築するには、強力なチップとデータセンターに莫大なお金を費やす必要があるという仮定です。この教義がどれほど基本的になったかを誇張することは困難です。 Microsoft、Meta、Googleなどの企業は、次世代のAIモデルを構築して実行するために必要だと考えていたインフラストラクチャを構築する数千億ドルをすでに費やしています。彼らは さらに数十億を費やすことを計画しています - または、Openaiの場合、5,000億ドルもの場合 OracleとSoftBankとの合弁事業 それは先週発表されました。Deepseekは、その建物R1の一部を費やしたようです。正確なコストはわかりません たくさんの注意事項を作る 彼らがこれまでにリリースした数字について。ほぼ確実に550万ドルを超えています。これは、会社が以前のモデルのトレーニングに費やしたと主張しています。しかし、R1がDeepseekの請求よりも10倍のトレーニングにかかったとしても、エンジニアの給与や基礎研究のコストなど、他のコストを考慮したとしても、アメリカのAIよりも桁違いに少ないでしょう。企業は、最も有能なモデルを開発するために費やしています。明らかな結論は、アメリカのハイテク大手がお金を無駄にしているということではありません。訓練された後に強力なAIモデルを実行することはまだ高価です。また、数千億ドルを費やすことは、OpenaiやGoogleなどの企業にとっても理にかなっていると考える理由があります。パック。しかし、コストに関するディープシェクのブレークスルーは、適切に訓練されたときに比較的小さなモデルが、はるかに大きなモデルのパフォーマンスに合わせたり超えることができることを示すことで、近年AIアームズレースを推進してきた「Bigger Is Better」の物語に挑戦しています。これは、AI企業が以前考えられていたよりもはるかに少ない投資で非常に強力な能力を達成できる可能性があることを意味します。そして、私たちはすぐに小さなAIの新興企業への投資の洪水が発生し、シリコンバレーの巨人とのはるかに多くの競争が見られる可能性があることを示唆しています。 (これは、モデルをトレーニングするための膨大なコストのため、ほとんどが今まで互いに競合してきました。)シリコンバレーの誰もがDeepseekに注意を払っている他のより技術的な理由はあります。研究論文では、同社はR1が実際にどのように構築されたかについてのいくつかの詳細を明らかにしています。これには、モデルの蒸留における最先端の技術が含まれています。 (基本的に、それは大きなAIモデルをより小さなものに圧縮することを意味し、パフォーマンスの邪魔にならずに走る方が安くなります。)Deepseekにはその詳細も含まれています 提案された 「バニラ」AI言語モデルをより洗練された推論モデルに変換すると考えられていたほど困難ではなかったこと。その上に強化学習として知られる手法を適用すること。 (これらの用語が頭を越えても心配しないでください。重要なのは、以前にアメリカのハイテク企業によって密接に守られていたAIシステムを改善する方法がウェブ上にあり、誰でも無料で複製できるようになっていることです。)アメリカのハイテク大手の株価が今後数日で回復したとしても、Deepseekの成功は、彼らの長期的なAI戦略に関する重要な疑問を提起します。中国企業が、高価なアメリカのモデルのパフォーマンスに合った安価でオープンソースモデルを構築できる場合、なぜ誰も私たちの代金を支払うのでしょうか?そして、あなたがメタ - 無料のオープンソースソフトウェアとしてモデルをリリースする唯一の米国のハイテク大手である場合、DeepSeekや別のスタートアップが単に数十億ドルを費やし、それらをより小さな蒸留を蒸留するのを防ぐもの、ペニーに提供できる安価なモデル?Deepseekのブレークスルーはまた、多くのアメリカの専門家がAI人種における中国の立場について行っていた地政学的な仮定のいくつかを覆しています。第一に、強力なAIモデルの構築に関しては、中国がフロンティアの背後に有意義にあるという物語に挑戦します。何年もの間、多くのAIの専門家(および彼らに耳を傾ける政策立案者)は、米国が少なくとも数年のリードを持っていると仮定しており、アメリカのハイテク企業が行った進歩をコピーすることは、中国企業が迅速に行うのは非常に困難でした。しかし、Deepseekの結果は、中国がOpenaiや他のアメリカ企業のモデルに一致またはそれを超えることができるAI機能を進めており、米国企業が行ったブレークスルーは、中国企業、または少なくとも1つの中国企業にとっては些細なことである可能性があることを示しています。数週間で。(ニューヨークタイムズは持っています 訴えた OpenaiとそのパートナーであるMicrosoftは、AIシステムに関連するニュースコンテンツの著作権侵害を彼らに非難しています。 OpenaiとMicrosoftはこれらの主張を否定しました。)結果はまた、米国政府が強力なAIシステムの拡散を敵に制限するために取っているステップ、つまり、強力なAIチップが中国の手に落ちるのを防ぐために使用される輸出管理が設計されているか、または設計されているか、または設計されているかどうかについての疑問を提起しますこれらの規制が、より効率的なトレーニングモデルを考慮に入れるために適応する必要があるかどうか。そして、もちろん、何百万人ものアメリカ人が使用する強力なAIシステムを構築するために中国が主導権を握った場合、それがプライバシーと検閲にとって何を意味するかについて懸念があります。 DeepSeekのモデルのユーザー 気づいた 彼らは、天安門広場虐殺やウイグル拘留キャンプなど、中国内の繊細なトピックに関する質問への回答を日常的に拒否していること。オープンソースソフトウェアによくあるように、他の開発者がDeepSeekのモデルの上に構築された場合、それらの検閲措置は業界全体に組み込まれる可能性があります。プライバシーの専門家も持っています 懸念を引き起こした Deepseekモデルと共有されているデータには、中国政府がアクセスできるという事実について。ティクトクが監視とプロパガンダの道具として使用されることを心配しているなら、ディープセークの台頭も心配するはずです。Deepseekのブレークスルーの完全な影響が何であるか、またはR1のリリースをAI業界の「Sputnik Moment」と見なすかどうかはまだわかりません。 主張した。しかし、私たちが今AIの瀬戸際の新しい時代にいる可能性を真剣に受け止めるのは賢明です。最大かつ裕福なアメリカのハイテク企業がデフォルトで勝てなくなる可能性があり、ますます強力なAIシステムの広がりを含むことはより難しいかもしれないということです私たちは思った。少なくとも、Deepseekは、AI Arms…

Silicon ValleyがAIについて信じていることをDeepseekが変えることができる理由

1738129158
2025-01-28 10:02:00

株式市場を通じて衝撃波を送り、シリコンバレーの巨人を吸い上げ、息をのむような息を切らしている人工知能のブレークスルーは、アメリカの技術的優位性の終わりについて到着しました。

22ページの紙、先週、Deepseekと呼ばれる粗末な中国のAIの新興企業によってリリースされましたが、すぐにアラームベルを引き起こしませんでした。研究者が論文の主張とそれが説明したことの意味を消化するのに数日かかりました。同社は、DeepSeek-R1と呼ばれる新しいAIモデルを作成しました。これは、控えめな数のAIチップを使用して、大手アメリカのAIモデルのパフォーマンスをわずかなコストで一致させたと主張した研究チームによって構築されました。

Deepseekは、巧妙なエンジニアリングを使用して、生のコンピューティング馬力を代用することでこれを行ったと述べました。そして、それは中国でそれをやった。多くの専門家が世界的なAIレースで遠い2位になっていると考えていた国。

一部の業界のウォッチャーは、最初はDeepseekの不信感に反応しました。確かに、彼らは、DeepseekがR1の結果を達成するためにだまされたか、モデルをより印象的に見せるために数字を倒したと考えていました。たぶん、中国政府は、アメリカのAI支配の物語を損なうためにプロパガンダを促進していたのかもしれません。たぶんdeepseekはそうでした 違法なnvidia H100チップの隠し場所を隠す、米国の輸出管理の下で禁止され、それについて嘘をついています。たぶん、R1は実際には、実際の進歩の方法であまり表していないアメリカのAIモデルの巧妙な再皮でした。

最終的に、より多くの人々がDeepSeek-R1の詳細を掘り下げるにつれて – ほとんどの主要なAIモデルとは異なり、オープンソースソフトウェアとしてリリースされ、部外者がその内部の仕組みをより密接に調べることができます – 彼らの懐疑論は心配に変わりました。

そして先週遅く、多くのアメリカ人がDeepseekのモデルを自分で使用し始め、DeepseekモバイルアプリがAppleのApp Storeでナンバーワンのスポットにヒットしたとき、それは本格的なパニックに陥りました。

私は、過去数日間にわたって見た中で最も劇的なテイクに懐疑的です。 1つのシリコンバレーの投資家、そのDeepseekは、アメリカの技術産業を破壊するための中国政府による精巧な陰謀です。また、会社の靴ひもの予算がひどく誇張されていること、またはそれが明らかにしていない方法でアメリカのAI企業が行った進歩に貯金したことはもっともらしいと思います。

しかし、DeepseekのR1ブレークスルーは本物だったと思います。業界のインサイダーとの会話と、1週間分の専門家が紙の調査結果を自分自身のためにテストし、テストしたことに基づいて、アメリカの技術産業が行ってきたいくつかの主要な仮定に疑問を投げかけているようです。

1つ目は、最先端のAIモデルを構築するには、強力なチップとデータセンターに莫大なお金を費やす必要があるという仮定です。

この教義がどれほど基本的になったかを誇張することは困難です。 Microsoft、Meta、Googleなどの企業は、次世代のAIモデルを構築して実行するために必要だと考えていたインフラストラクチャを構築する数千億ドルをすでに費やしています。彼らは さらに数十億を費やすことを計画しています – または、Openaiの場合、5,000億ドルもの場合 OracleとSoftBankとの合弁事業 それは先週発表されました。

Deepseekは、その建物R1の一部を費やしたようです。正確なコストはわかりません たくさんの注意事項を作る 彼らがこれまでにリリースした数字について。ほぼ確実に550万ドルを超えています。これは、会社が以前のモデルのトレーニングに費やしたと主張しています。

しかし、R1がDeepseekの請求よりも10倍のトレーニングにかかったとしても、エンジニアの給与や基礎研究のコストなど、他のコストを考慮したとしても、アメリカのAIよりも桁違いに少ないでしょう。企業は、最も有能なモデルを開発するために費やしています。

明らかな結論は、アメリカのハイテク大手がお金を無駄にしているということではありません。訓練された後に強力なAIモデルを実行することはまだ高価です。また、数千億ドルを費やすことは、OpenaiやGoogleなどの企業にとっても理にかなっていると考える理由があります。パック。

しかし、コストに関するディープシェクのブレークスルーは、適切に訓練されたときに比較的小さなモデルが、はるかに大きなモデルのパフォーマンスに合わせたり超えることができることを示すことで、近年AIアームズレースを推進してきた「Bigger Is Better」の物語に挑戦しています。

これは、AI企業が以前考えられていたよりもはるかに少ない投資で非常に強力な能力を達成できる可能性があることを意味します。そして、私たちはすぐに小さなAIの新興企業への投資の洪水が発生し、シリコンバレーの巨人とのはるかに多くの競争が見られる可能性があることを示唆しています。 (これは、モデルをトレーニングするための膨大なコストのため、ほとんどが今まで互いに競合してきました。)

シリコンバレーの誰もがDeepseekに注意を払っている他のより技術的な理由はあります。研究論文では、同社はR1が実際にどのように構築されたかについてのいくつかの詳細を明らかにしています。これには、モデルの蒸留における最先端の技術が含まれています。 (基本的に、それは大きなAIモデルをより小さなものに圧縮することを意味し、パフォーマンスの邪魔にならずに走る方が安くなります。)

Deepseekにはその詳細も含まれています 提案された 「バニラ」AI言語モデルをより洗練された推論モデルに変換すると考えられていたほど困難ではなかったこと。その上に強化学習として知られる手法を適用すること。 (これらの用語が頭を越えても心配しないでください。重要なのは、以前にアメリカのハイテク企業によって密接に守られていたAIシステムを改善する方法がウェブ上にあり、誰でも無料で複製できるようになっていることです。)

アメリカのハイテク大手の株価が今後数日で回復したとしても、Deepseekの成功は、彼らの長期的なAI戦略に関する重要な疑問を提起します。中国企業が、高価なアメリカのモデルのパフォーマンスに合った安価でオープンソースモデルを構築できる場合、なぜ誰も私たちの代金を支払うのでしょうか?そして、あなたがメタ – 無料のオープンソースソフトウェアとしてモデルをリリースする唯一の米国のハイテク大手である場合、DeepSeekや別のスタートアップが単に数十億ドルを費やし、それらをより小さな蒸留を蒸留するのを防ぐもの、ペニーに提供できる安価なモデル?

Deepseekのブレークスルーはまた、多くのアメリカの専門家がAI人種における中国の立場について行っていた地政学的な仮定のいくつかを覆しています。

第一に、強力なAIモデルの構築に関しては、中国がフロンティアの背後に有意義にあるという物語に挑戦します。何年もの間、多くのAIの専門家(および彼らに耳を傾ける政策立案者)は、米国が少なくとも数年のリードを持っていると仮定しており、アメリカのハイテク企業が行った進歩をコピーすることは、中国企業が迅速に行うのは非常に困難でした。

しかし、Deepseekの結果は、中国がOpenaiや他のアメリカ企業のモデルに一致またはそれを超えることができるAI機能を進めており、米国企業が行ったブレークスルーは、中国企業、または少なくとも1つの中国企業にとっては些細なことである可能性があることを示しています。数週間で。

(ニューヨークタイムズは持っています 訴えた OpenaiとそのパートナーであるMicrosoftは、AIシステムに関連するニュースコンテンツの著作権侵害を彼らに非難しています。 OpenaiとMicrosoftはこれらの主張を否定しました。)

結果はまた、米国政府が強力なAIシステムの拡散を敵に制限するために取っているステップ、つまり、強力なAIチップが中国の手に落ちるのを防ぐために使用される輸出管理が設計されているか、または設計されているか、または設計されているかどうかについての疑問を提起しますこれらの規制が、より効率的なトレーニングモデルを考慮に入れるために適応する必要があるかどうか。

そして、もちろん、何百万人ものアメリカ人が使用する強力なAIシステムを構築するために中国が主導権を握った場合、それがプライバシーと検閲にとって何を意味するかについて懸念があります。 DeepSeekのモデルのユーザー 気づいた 彼らは、天安門広場虐殺やウイグル拘留キャンプなど、中国内の繊細なトピックに関する質問への回答を日常的に拒否していること。オープンソースソフトウェアによくあるように、他の開発者がDeepSeekのモデルの上に構築された場合、それらの検閲措置は業界全体に組み込まれる可能性があります。

プライバシーの専門家も持っています 懸念を引き起こした Deepseekモデルと共有されているデータには、中国政府がアクセスできるという事実について。ティクトクが監視とプロパガンダの道具として使用されることを心配しているなら、ディープセークの台頭も心配するはずです。

Deepseekのブレークスルーの完全な影響が何であるか、またはR1のリリースをAI業界の「Sputnik Moment」と見なすかどうかはまだわかりません。 主張した

しかし、私たちが今AIの瀬戸際の新しい時代にいる可能性を真剣に受け止めるのは賢明です。最大かつ裕福なアメリカのハイテク企業がデフォルトで勝てなくなる可能性があり、ますます強力なAIシステムの広がりを含むことはより難しいかもしれないということです私たちは思った。

少なくとも、Deepseekは、AI Arms Raceが本当にオンになっており、数年の目を見張るような進歩の後、さらに驚きが残っていることを示しています。

#Silicon #ValleyがAIについて信じていることをDeepseekが変えることができる理由

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。