世界を驚かせたディープシーク AI モデルを開発した中国金融界の巨人、梁文峰氏]が、2025 年の科学界を形作る人材を選ぶネイチャー 10 に選ばれました。
エリザベス・ギブニー
今年1月、中国からの発表が人工知能の世界を震撼させた。 DeepSeekという会社が突然現れました。 強力でありながら手頃な価格の R1 モデルの発売により、米国は多くの専門家の期待通りの成果を上げています。 AI分野では先行していない 事実はすぐに明らかになった。
これ 爆発的なアナウンス その背後にいるのは、40歳の元金融アナリスト、ウェンフェン・リャン氏だ。 AIアルゴリズムを株式市場に適用して数百万ドルを稼いだ後、2023年にその資金を使って杭州にDeepSeekを設立したと伝えられている。梁文峰氏は脚光を浴びることを避けており、中国メディアとのインタビューは数回しか行っていない( 自然 (取材依頼は拒否されました)。
リャン氏のモデルは秘密であると同時に公にされている。 R1 は、数学やコーディングなどの複雑なタスクをステップに分割して解決することに優れた「推論型」大規模言語モデル (LLM) です。このモデルは最初に公開バージョンでリリースされました。 無料でダウンロードして構築 つまり、あなたにはそれができるということです。したがって、このアルゴリズムを自分の分野に適用したいと考えている研究者にとっては非常に役立ちます。
DeepSeek の成功は、 中国 クラス アメリカ合衆国 これにより、他の企業も DeepSeek に倣い、独自の公開モデルを立ち上げたようです。
AI 専門家らは、R1 には ChatGPT を支えるモデルを含め、米国の最高のモデルと同等の多くの機能があるにもかかわらず、そのトレーニング コストは競合他社よりもはるかに低かったと述べています。たとえば、Meta の Llama 3 405B モデルのトレーニングには 10 倍以上のコストがかかります。 DeepSeek の透明性の追求は 9 月に確認されました。 これは拡張され、R1 の構築方法とトレーニング方法の詳細が明らかになりました。 査読 これは最初のメジャー LLM となりました ( D.郭 他。自然 645、633–638; 2025年 ).レシピを公開することで、DeepSeek は他の AI 研究者に推論モデルのトレーニング方法を教えました。
「DeepSeek はさまざまな面で多大な影響を与えています」と、ニューヨーク市に拠点を置くコミュニティ AI プラットフォームである Hugging Face の研究者、Adina Yakepu は言います。
AI の頂点は、梁氏が 2 人の小学校教師の息子として育った広東省の村から遠く離れています。高等教育に関しては、2010 年に杭州の名門浙江大学で工学修士号を取得しました。彼の卒業論文のテーマは、ビデオ内のオブジェクトを追跡するアルゴリズムの開発でした。彼はすぐに AI への愛情を金融市場に応用し、2015 年にヘッジファンドのハイフライヤーを共同設立し、2023 年にディープシークをスピンオフしました。
当時、中国は LLM の開発に困難を抱えていました。米国の輸出規制により、中国企業は米国のチップメーカー、エヌビディア製のグラフィックス処理装置(GPU)と呼ばれる、LLMトレーニングに適した強力なコンピュータチップを購入することができなくなっている。しかし、梁氏はすでに十分な資金を持っていた。過去 10 年間で 10,000 個の NVIDIA GPU を購入したことが、GPU の研究への好奇心を刺激しました。中国メディア企業36Krとの2023年のインタビューで、同氏は今回の購入を自宅用のピアノの購入に例えた。 「ピアノを買う余裕があるなら、それで音楽を演奏したい人もいるでしょう。」
多くの西欧の AI 起業家と同様に、梁氏は一般人工知能 (AI)、つまり人間と同じように認知タスクに熟達した AI システムに目標を定め、それを目指して会社を設立した、とディープシークの元研究員ベンジャミン・リュー氏は述べています。同社は採用の際に経験よりも可能性を優先しており(DeepSeek R1論文の著者の1人はまだ中学生)、上下関係もほとんどないため、研究者が自分で何を研究するかを決めている。梁氏は研究に深く関わっていることで知られており、研究者の劉氏は「私のようなインターンでも、有意義な責任を持って正社員のように扱われた」と述べた。
#네이처 #세계를 #놀라게 #한 #DeepSeek #모델을 #개발한 #중국 #금융계의 #거장 #량원펑 #彼は2025 #年の科学コミュニティを形成する人物を選出する #Nature #に選ばれました #Net