米国商務長官のハワード・ルトニックは、杭州を拠点とする人工知能(AI)企業であるディープシェクを、米国の技術を盗み、米国の輸出管理を回避してハイエンドのNVIDIAチップを取得したと非難しています。
1月29日に米国上院との指名審理で、Lutnick 言った DeepSeekは、大量のNVIDIAチップを購入してMetaのオープンプラットフォームからデータを盗むことができたため、AIモデル「Dirt Cheap」を作成できます。
「私は中国の非常に黄undな景色を眺めることができます」と彼は言いました。 「彼らは自分自身について考え、私たちを傷つけようとするだけなので、私たちは自分自身を守る必要があります。私たちはイノベーションを促進する必要があり、彼らを助けるのをやめる必要があります。 MetaのオープンプラットフォームLet Deepseekはそれに依存しています。 Nvidiaのチップ – 彼らは大量に買った、そして彼らは彼らの方法を見つけた [export controls] – DeepSeekモデルを運転します。終わらなければなりません。」
Lutnickは、中国がアメリカと競争するためにアメリカのツールを使用するのを止めるために、産業と安全保障局(BIS)の輸出管理と関税を調整し、力を与えると述べました。
北京はこれまでのところ、1月28日から2月4日まで中国の旧正月を祝っているため、Lutnickのコメントには応答していません。
元PayPalの最高執行責任者であり、AIおよび暗号通貨の問題に関するホワイトハウスのアドバイザーであるDavid Sacks、 言った Fox Newsは、Deepseekが「蒸留」と呼ばれる方法を使用してMicrosoftのOpenaiモデルからデータを抽出し、独自の使用を抽出したという「実質的な証拠」があったことを示しています。
IT専門家 言った 「蒸留」または「知識蒸留」は、一般的にAIトレーニングで使用されます。これは、より大きなAIモデルからの出力を使用して、より小さなモデルを訓練および改善する手法です。
このプロセスでは、Deepseekは、知識豊富な教師、たとえばChatGptなどの質問をし続け、答えを使用してその論理を微調整する生徒として理解できます。ある時点で、DeepseekはChatGptと同じくらい賢くなります。
「蒸留」プロセスでは、OpenaiがChatGptを訓練するために使用したものよりもはるかに少ないコンピューティングパワーが必要です。
Openai 言った Deepseekが「蒸留」を通じてデータをタップした可能性があることを示唆するいくつかの証拠を見た金融時代。それは、その知的財産に違反したことでDeepseekを批判しました。
中国のIT専門家の中には、Deepseekが「蒸留」を通じて作成されたことに同意しています。
彼は、他の多くの中国のAIモデルが昨年9月12日にリリースされたChatGPT O1の蒸留データも使用していると言います。彼はそれを言います アカデミックペーパー 2024年11月25日に中国の研究者グループが発行したことは、蒸留プロセスとその有効性について詳細にすでに説明しています。
彼は、蒸留データで作られたAIモデルは非常に難しい質問に答えることができないかもしれないが、高校レベルの問題を解決するのに十分であると言います。彼の見解では、すべての小さなAIモデルは、市場に参入する前に蒸留データで自分自身を改善するはずです。
「短いカットをした人を笑わないでください!」王は言う。 「DeepSeekは、コンピューティングパワーを節約するために特別な方法を使用しました。結局のところ、そのトレーニングコストはわずか558万米ドルで、メタのラマ3.1の5億米ドルの1.1%です。」
2025年1月20日にDeepSeek-R1をリリースした後、DeepSeek研究者のグループが公開しました 紙 1月22日、最新のAIモデルはChatGpt-O1に匹敵するパフォーマンスを達成すると述べています。
彼らは、Deepseek-R1のトレーニングが蒸留データをAlibabaのTongyi Qianwen(Qwen)とMetaのLlamaから使用したと述べた。彼らは、deepseek-r1-distill-qwenバージョンがchatgpt-4oを上回ると言いました。
50,000 H100チップ?
Deepseekは、AIモデルをトレーニングするためにNvidiaのH800チップの2,000単位しか使用していないと述べました。中国のヘッジファンドであるParent High Flyerは、2022年10月に米国がチップの中国への輸出を禁止する前に、10,000 A100チップのクラスターを集めたと述べました。
しかし、Lutnickは、Singaporeなどの第三者を介してハイエンドのNvidiaチップを輸入することにより、Deepseekが米国の輸出管理をバイパスしたと疑っています。
ウォールストリートジャーナル 報告されています 昨年7月、シンガポールのいくつかの危険な機関がNvidiaのA100チップスを購入し、中国の学生に中国に戻ってきました。
証拠を提供することなく、米国を拠点とする規模のAIの最高経営責任者であるAlexandr Wang、 言った Deepseekが50,000ユニットのH100チップを持っているCNBCは、市場で最も高度なNvidiaチップです。
湖岸に拠点を置くITライターであるXiang Zhipingは、それがもっともらしいと感じています。 「Deepseekに50,000 H100チップがあっても驚くことではありません。中国のインターネットの巨人は、多くのnvidiaチップを蓄積した可能性があります」 言う。
Deepseekに多くのチップがある場合でも、米国の企業の足跡をたどってコンピューティングパワーを無限に高めるのではなく、ソフトウェアと新しいITフレームワークを使用してゲームに勝つためにソフトウェアと新しいITフレームワークを使用します。
米国は、2022年10月にA100およびH100チップスの中国への輸出を禁止し、その後2023年10月にA800とH800チップスが遅くなりました。この後、Nvidiaは中国市場向けに均等なH20チップを調整しました。
2025年1月14日、バイデン政権は、アメリカのAIチップとモデルの輸出を制限する規制の枠組みを発表しました。フレームワークは1月31日に施行されました。
一部のオブザーバーは、チップ禁止の段階的な強化により、中国がハイエンドのAIチップを蓄積するのに時間がかかりすぎると述べています。
ヨン・ジアンはアジア・タイムズの貢献者です。彼は中国のジャーナリストであり、中国の技術、経済、政治を専門としています。
#遅すぎると米国の商取引候補者はdeepseekをテクノロジー泥棒と呼びます