1738540769
2025-01-31 15:00:00
Deepseekからわずか1週間が経ちました AIの世界を倒しました。そのオープンウェイトモデルの導入 – 専門化されたほんの一部でトレーニングされました コンピューティングチップ その権力業界のリーダーは、Openai内の衝撃波を切り離しました。従業員は、DeepseekがOpenaiのモデルを「不適切に蒸留した」というヒントを見て独自のモデルを作成したと主張しただけでなく、Startupの成功により、Openaiのような企業がコンピューティングに非常に過剰に費やしているかどうかを疑問視していました。
「Deepseek R1はAIのSputnikの瞬間です」と、シリコンバレーの最も影響力のある挑発的な発明者の1人であるMarc Andreessenは書いています。 x。
これに応じて、Openaiは本日、当初計画されていたスケジュールに先立って、新しいモデルを起動する準備をしています。モデル、O3-Miniは、APIとチャットの両方でデビューします。情報筋によると、4oレベルの速度でO1レベルの推論があると述べています。言い換えれば、それは速く、安く、スマートで、deepseekを粉砕するように設計されています。 (OpenaiのスポークスマンであるNiko Felixは、O3-Miniの作業がDeepseekのデビューのずっと前に始まり、目標は1月末までに開始することだったと言います)。
その瞬間には、Openaiのスタッフが亜鉛メッキされています。社内では、特にディープセックが会話を支配するように、オペナイはより効率的になったり、最新の競合他社に遅れをとったりする危険を冒す必要があると感じています。
問題の一部は、利益を求める大国になる前の非営利の研究組織としてのOpenaiの起源に由来しています。従業員は、研究グループと製品グループ間の継続的な権力闘争は、高度な推論に取り組んでいるチームとチャットに取り組んでいるチームとの間に裂け目をもたらしたと主張しています。 (OpenaiのスポークスマンであるNiko Felixは、これは「間違っている」と述べ、これらのチームのリーダー、最高製品責任者のKevin Weil、および最高研究責任者のMark Chenは、「毎週会い、製品と研究の優先順位に沿って緊密に協力しています。」)
内部のOpenaiは、会社に統一されたチャット製品を構築することを望んでいます。これは、質問に高度な推論が必要かどうかを知ることができるモデルです。これまでのところ、それは起こっていません。代わりに、ChatGPTのドロップダウンメニューは、ユーザーがGPT-4O(「ほとんどの質問に最適」)またはO1(「高度な推論を使用」)を使用するかどうかを決定するように求めます。
一部のスタッフは、チャットがOpenaiの収益の大部分をもたらす一方で、O1はリーダーシップからより多くの注意とコンピューティングリソースを得ると主張しています。 「リーダーシップはチャットを気にしません」と、(あなたが推測した)チャットに取り組んだ元従業員は言います。 「誰もがセクシーだからO1に取り組みたいと思っていますが、コードベースは実験用に構築されていなかったため、勢いはありません。」元従業員は、非公開契約を引用して、匿名のままにするように頼みました。
Openaiは、最終的にO1と呼ばれる高度な推論システムになったモデルを微調整するための強化学習を実験するために何年も費やしました。 (強化学習は、罰則と報酬のシステムでAIモデルを訓練するプロセスです。)Deepseekは、R1と呼ばれる高度な推論システムを作成するためにOpenaiが先駆者にした強化学習作業を構築しました。 「彼らは、言語モデルに適用され、機能する強化学習を知ることで恩恵を受けました」と、会社について公に話すことを許可されていない元Openaiの研究者は言います。
「強化学習 [DeepSeek] DIDは、Openaiで行ったことに似ています」と、別の元Openaiの研究者は言います。「しかし、彼らはより良いデータとクリーンスタックでそれをしました。」
Openaiの従業員は、O1に入った研究は、速度のために構築された「ベリー」スタックと呼ばれるコードベースで行われたと言います。 「トレードオフがありました。スループットに対する実験的な厳密です」と、この状況を直接知る元従業員は言います。
これらのトレードオフは、本質的には巨大な実験であり、コードベースの制限にもかかわらず、本質的に大きな実験でした。彼らは、異なる、より信頼性の高いスタックに基づいて構築された数百万人のユーザーが使用する製品であるチャットについてはそれほど意味がありませんでした。 O1が発射して製品になったとき、Openaiの内部プロセスで亀裂が出現し始めました。 「「なぜ実験的なコードベースでこれを行うのか、主な製品研究コードベースでこれを行うべきではないのか」と従業員は説明します。 「それを内部的に大きなプッシュバックがありました。」
#DeepseekはOpenaiを解雇しました