業界をリードするAIカバレッジに関する最新のアップデートと排他的なコンテンツについては、毎日および毎週のニュースレターに参加してください。 もっと詳しく知る
Openaiは、ラピッドに対抗するために時間内に新しい独自のAIモデルをリリースしました オープンソースのライバルDeepseek-R1の台頭 – しかし、後者の成功を鈍らせるだけで十分でしょうか?
今日、数日間の噂とソーシャルメディアでのAIユーザーの期待の増加の後、 OpenalはO3-Miniをデビューしています、「推論者」の新しいファミリーの2番目のモデル – 「考える」ためにわずかに時間をかけ、独自のプロセスを分析し、新しい出力を使用したユーザークエリと入力に応答する前に独自の「思考のチェーン」を反映するALモデル。
その結果、数学、科学、工学、その他多くの分野の難しい質問に答えることで、博士課程の学生または学位保持者のレベルで実行できるモデルができます。
O3-MINIモデルは、フリーティアを含むChATGPTおよびOpenAIのアプリケーションプログラミングインターフェイス(API)で利用可能になりました。そして、実際には、以前のハイエンドモデルであるOpenaiのO1と、より速く低パラメーター兄弟O1-Miniよりも、実際には安価で、より速く、よりパフォーマンスが高くなっています。
必然的にそれはDeepSeek-R1と比較されますが、リリース日は反応と見なされますが、O3とO3-MINIは1月のDeepSeek R1のリリースの前に発表されたことを覚えておくことが重要です。 2024年12月、そしてそのOpenai CEOのSam Altman xで以前に記載されています 開発者と研究者からのフィードバックにより、ChatGptとOpenai APIが同時に来ることになります。
DeepSeek-R1とは異なり、O3-MINIはオープンソースモデルとして利用可能にされません。つまり、コードをオフライン使用のためにダウンロードすることも、同じ程度にカスタマイズできないため、一部のアプリケーションのDeepSeek-R1と比較して魅力を制限する可能性があります。 。
Openaiは、12月にO3-Miniとともに発表された(推定)より大きなO3モデルに関する詳細を提供しませんでした。その時点で、OpenaiのOpenaiのオプトインドロップダウンフォームは、O3がサードパーティがテストする前に「数週間の遅延」を受けることになると述べました。
パフォーマンスと機能
O1と同様に、Openai O3-Miniは数学、コーディング、科学の推論に最適化されています。
そのパフォーマンスは、中程度の推論努力を使用する場合のOpenai O1に匹敵しますが、次の利点を提供します。
- O1-MINIと比較して応答時間が24%速い(Openaiはここで特定の数を提供しませんでしたが、サードパーティの評価グループを見ています 人工分析のテスト、O1-MINIの応答時間は、100トークンを受信および出力するのに12.8秒です。したがって、O3-MINIの場合、24%の速度バンプは応答時間を10.32秒に低下させます。)
- 外部テスターは、56%の時間O3-MINIの応答を好む外部テスターでの精度が向上しました。
- 複雑な現実世界の質問に対する39%少ない主要なエラー。
- 特に高い推論努力を使用する場合、コーディングおよびSTEMタスクのパフォーマンスが向上します。
- 3つの推論努力レベル(低、中、高)により、ユーザーと開発者が精度と速度のバランスをとることができます。
また、このモデルは、オンラインでリリースされたO3-MINIシステムカードOpenai(公式モデルの可用性発表よりも早く公開されていた)によると、印象的なベンチマークを誇っており、場合によってはO1を上回っています。
O3-MINIのコンテキストウィンドウ – 単一の相互作用で入力/出力を入力できるトークンの合計数 – は200,000で、各出力で最大100,000です。これは完全なO1モデルと同じです deepseek–R1のコンテキストウィンドウ 約128,000/130,000トークンの。しかし、それははるかに下にあります Google Gemini 2.0フラッシュ思考 最大100万トークンの新しいコンテキストウィンドウ。
O3-MINIは推論機能に焦点を当てていますが、ビジョン機能はまだありません。画像とファイルのアップロードを検討している開発者とユーザーは、その間にO1を使用し続ける必要があります。
競争は熱くなります
O3-MINIの到着は、OpenAIが初めての到着時に、無料のChatGPTユーザーが利用できる推論モデルを作成しています。以前のO1モデルファミリは、ChatGPT Plus、Pro、およびその他のプランのサブスクライバー、およびOpenaiの有料APIを介してのみ利用可能でした。
2022年11月にChatGPTの発売を介して大規模な言語モデル(LLM)を使用したチャットボットで行ったように、Openaiは2024年9月にReasoning Modelsのカテゴリ全体を基本的に作成しました 最初にO1を発表したとき、新しいトレーニング体制とアーキテクチャを持つモデルのクラス。
しかし、Openaiは、最近の歴史に沿って、その名前とオリジナルの設立ミッションに反して、O1オープンソースを作成しませんでした。代わりに、モデルのコード専有を保持しました。
そして、過去2週間にわたって、O1は 中国のAIスタートアップDeepseek、ライバルで、非常に効率的で、大部分がオープンソースの推論モデルであるR1を発売しました。世界中の誰でも撮影、再訓練、カスタマイズできます。トップラボからのO1およびその他のLLMのコストの割合。
deepseek-r1 寛容なMITライセンス条件、消費者向けの無料アプリ/ウェブサイトとR1のコードベースを自由に利用できるようにする決定は、消費者市場とエンタープライズ市場の両方で使用できる真正な爆発に導きました。 Openai Investor Microsoft そして、人類の支援者Amazonは、クラウドマーケットプレイスにそのバリエーションを追加するために急いでいます。 AI検索会社であるPrplexityも迅速です ユーザーにバリアントを追加しました。
Deepseekはまた、ChatGPT iOSアプリをNo.1番号として退位させました 私たちApple App Store、R1モデルをアプリおよびWebでWeb検索に接続することにより、OpenAIを上回ることで注目に値します。これは、OpenaiがO1に対してまだ行っていないことであり、ハイテクワーカーやその他のオンラインでさらにテクノ不安を引き起こし、中国がAIイノベーション、またはより一般的にテクノロジーで米国を追い越しているか、より一般的には米国を上回っています。
しかし、Marc Andreessenなどの多くのAIの研究者、科学者、およびトップVCは、Deepseekの台頭と、特にそのオープンソースをAIフィールドのすべてのボートを持ち上げ、コストを削減しながら誰もが利用できるインテリジェンスを増やすことを歓迎しています。 。
chatgptの可用性
O3は現在、グローバルに展開して無料でChatGpt、さらにチームとプロのユーザーであり、エンタープライズと教育へのアクセスが来週登場します。
- 無料のユーザーは、チャットバーの「理由」ボタンを選択したり、応答を再生したりすることで、O3-Miniを初めて試すことができます。

- メッセージの制限により、プラスおよびチームユーザーの3倍が増加し、1日あたり50から150のメッセージが増加しました。
- Proユーザーは、O3-MINIと、さらに高リアーシングのバリアントであるO3-Mini-Highの両方に無制限にアクセスできます。
さらに、O3-MINIはCHATGPT内の検索統合をサポートし、関連するWebリンクを使用して応答を提供するようになりました。 Openaiが推論モデル全体で検索機能を改良するため、この機能はまだ初期段階にあります。
APIの統合と価格設定
開発者の場合、O3-MINIはChat Completions API、アシスタントAPI、バッチAPIを介して利用できます。このモデルは、機能の呼び出し、構造化された出力、開発者メッセージをサポートし、実際のアプリケーションに簡単に統合できるようにします。
O3-MINIの最も注目すべき利点の1つは、コスト効率です。OpenaiO1-MINIよりも63%安く、O1モデル全体よりも93%安く、100万ドル/100トークンあたり1.10ドル/$ 4.40の価格(50%キャッシュ割引) )。
それでも、それはまだ役人の手頃な価格と比較して見劣りします Deepseek APIR1の$ 0.14/$ 0.55で100トークンあたり0.55ドルの入力/OUTで提供されています。しかし、DeepSeekは中国に拠点を置いており、モデルに出入りするユーザー/エンタープライズのデータに関するアテンダント地政学的認識とセキュリティの懸念が付属しているため、OpenAIは米国の一部のセキュリティ中心の顧客および企業にとって好ましいAPIであり続ける可能性があります。とヨーロッパ。
また、開発者は、アプリケーションのニーズに基づいて推論努力レベル(低、中、高)を調整し、遅延と精度のトレードオフをより強化できるようにすることもできます。
安全性について、Openaiは、O3-Miniとの「審議アライメント」と呼ばれるものを使用したと言います。これは、モデルが与えられた人間が執筆した安全ガイドラインについて推論するように求められ、それらの意図とそれらがそれらの害を防ぐための独自の方法を思い付くように設計されている害をより多く理解するように求められたことを意味します。 Openaiは、安全性を維持しながら、デリケートなトピックを議論するときにモデルの検閲を少なくすることを可能にすると言います。
Openai氏によると、このモデルは、安全性と脱獄の課題の処理においてGPT-4oを上回り、今日のリリース前に広範な外部安全テストを実施したと言います。
a でカバーされた最近のレポート 有線 (私の妻が働いている場所)は、Deepseekがすべての脱獄プロンプトに屈し、セキュリティ研究者によってテストされた50人のうち50人を試みたことを示しました。
何ですか 次?
O3-MINIの発売は、DeepseekのR1などからかつてないほど激しい競争に直面して、高度な推論AIをよりアクセスしやすく、費用対効果の高いOpenaiのより広範な取り組みを表しています。これには、最近独自のライバル推論モデルの無料版をリリースしたGoogleが含まれます ジェミニ2フラッシュ思考 最大100万トークの入力コンテキストが拡張されています。
STEMの推論と手頃な価格に焦点を当てたOpenaiは、消費者と開発者の両方のアプリケーションでAI駆動型の問題解決の範囲を拡大することを目指しています。
しかし、会社がこれまで以上に野心的になるようになるにつれて、たとえば、最近、5,000億ドルのデータセンターインフラストラクチャプロジェクトを発表しました。 スターゲート SoftBankからの支援により、その戦略が数十億の沈んだものを正当化するのに十分なほど十分に報われるかどうかという問題は残ります 深い投資家 Microsoftやその他のVCなど。
オープンソースモデルがますますパフォーマンスの中でOpenaiでギャップを閉じ、コストでそれを上回ると、特にエンタープライズでは、顧客を維持するのに十分な優れた安全対策、強力な能力、使いやすいAPI、ユーザーフレンドリーなインターフェイスが十分になります。 – これらの属性よりもコストと効率を優先するのは誰ですか?いつものように、私たちは展開中に開発について報告します。