業界をリードするAIカバレッジに関する最新のアップデートと排他的なコンテンツについては、毎日および毎週のニュースレターに参加してください。もっと詳しく知る
Microsoft、Google、および人類からのイベントに続くAIの発表にとって大きな週でした。しかし、Openaiはそれ自体のニュースで物事を終えています。いいえ、私たちはただ話しているだけではありません Jony Iveのデザインチームの約65億ドルの買収 リードする 新しいハードウェアの取り組み、Openaiの「IO」。
今日、 会社はオペレーターをアップグレードしました 以前のGPT-4Oマルチモーダル大型言語モデルをより強力で強力なO3推論モデルに使用することから、CHATGPT内の自律的なWebブラウジングとカーソル制御エージェント。
2025年5月23日、世界でリリースされた更新は、Openaiの200ドルのChatGPT Proプランの加入者に支払うための「研究プレビュー」として利用できます。
基本的に、それは、それが完全に「サンディング」されていない、または完成した製品ではないと言うOpenaiの方法です。まだねじれや問題があるかもしれません。
しかし、 ライバルGoogleは、定期的に250ドル近くの価格で独自のトップティアAIサブスクリプションバンドルを提供しています (現在、最初の3か月間に125ドルまで割引を実行しています)最新のGemini Multimodal、Imagen Image Generation、およびVEOビデオ生成モデルにアクセスするために、OpenaiのChatGPT Proプランはより手頃な価格のようです。
Openaiのオペレーターとは何ですか?それは何のためですか?
オペレーターは、2025年1月にオープンの最初のステップとして、特にエージェントを使用したコンピューター(CUAS)を使用して初めてデビューしました。アイデアは、ChatGPTのChatBotインターフェイスを超えて、OpenAIの強力なAIモデルがユーザーに代わってより多くのアクションを実行し始めることを許可することです。
したがって、オペレーターは、ディナー予約の予約、買い物リストの編集、注文イベントチケットなどのWebベースのタスクを自律的にポイント、クリック、スクロール、入力するように設計されています。このエージェント機能により、予約の予約からオンラインデータの収集まで、ブラウザーインターフェイスを介してユーザータスクを直接完了できます。
安全性、プライバシー、セキュリティの目的で、オペレーターはユーザーのPCまたはMacで既存のWebブラウザーを使用しませんでした。代わりに、スタンドアロンサイトを介してアクセス可能なクラウドホストの仮想ブラウザで実行されました— Operator.chatgpt.com – ユーザーがリクエストを入力して、エージェントの実行タスクをリアルタイムで観察することができます。
GPT-4Oに基づいたビジョン、推論、および相互作用機能を組み合わせて、エージェントAIのOpenAIの新しい方向性を示しました。
この製品は、CHATGPT Proサブスクライバーの調査プレビューとして発売され、ユーザー確認、視聴モード、リスクの高いWebプラットフォームの制限などの組み込みの安全対策を特徴としていました。
また、旅行計画や市民サービスを含むエンタープライズのコンテキストでテストされており、消費者とビジネス環境の両方でその可能性を示しています。
O3は、精度、構造、成功率の向上を提供します
この更新により、Openaiはいくつかの重要な次元にわたってパフォーマンスを向上させることを目指しています。新しいO3ベースのオペレーターは、ブラウザーの相互作用中の持続性と精度の向上を示しています。
実際には、これはユーザータスクを正常に完了し、修正または繰り返しの必要性が少ない可能性が高いことを意味します。さらに、ユーザーは、より明確で、より構造化され、より包括的な応答を期待できます。
比較評価では、新しいモデルは、その前身よりも明確な好みの優位性を示しています。人間の好みの研究により、ユーザーはそのスタイル、包括性、明確さについてO3モデルを好むことが明らかになりました。また、事実上の正確性の結果はバージョン間でよりバランスが取れているが、指示のフォローと効率で強く機能する。

ただし、Openaiは、自動化されたグレーディングシステムの制限により、実際のパフォーマンスゲインは20パーセントポイントに近づく可能性があると指摘しています。
Webarenaでは、新しいモデルは48.1から62.9のスコアを達成しました。最も劇的な改善は、Gaia Benchmarkに表示されます。O3モデルは62.2をスコアリングし、以前のモデルの12.3を大幅に超えています。

セーフガードは、敏感な金融取引およびアカウントアクセスに関する使用に関する一般的な注意メモと同様に残ります
また、O3モデルは、以前のバージョンで導入された安全対策を継承し、エージェントシステムとしての役割をさらに微調整します。
Openaiは、有害なタスクの実行、迅速な注入の脆弱性、およびユーザーの意図に関連する間違いに対する強化されたトレーニングを統合しました。
評価によると、モデルは、そのモデルを実行する前に94%の機密アクションを確認し、金融取引で100%の確認を示しています。迅速な注射感受性も23%から20%に減少しています。
特に、O3オペレーターは、電子メールや金融プラットフォームなどの特定のリスクの高いWebインタラクションの慎重な境界を維持しています。ここでは、時計モードを介してユーザーの監督が必要になるか、進行を明示的に拒否します。これらの測定値は、モデルレベルの堅牢性とリアルタイムモニタリングを組み合わせた安全性への層状アプローチの一部です。
オペレーターへのアップグレードは技術的な改善を示していますが、責任あるAI展開に対するOpenaiの継続的なコミットメントも反映しています。
現実世界のアクションを実行するシステムの能力は新しいリスクをもたらし、開発チームはそれに応じて安全プロトコルを改良し続けています。
によると Openaiの更新されたO3システムカードドキュメント、このモデルは、生物学的および化学的誤用などのカテゴリのリスクの高い能力のしきい値を下回っており、ネイティブのコーディング環境や端子アクセスがないため、潜在的な誤用ベクターがさらに減少します。
オペレーターは引き続き調査のプレビューであり、ChATGPT Proユーザーにのみアクセスできます。オペレーターの回答APIバージョンは、少なくとも今のところGPT-4Oモデルに基づいています。
エンタープライズの技術意思決定者への影響
アップグレードされたオペレーターは、AIエンジニアリング、オーケストレーション、データ管理、およびITセキュリティの専門家のワークフローを大幅に向上させるために立っています。
機械学習モデルの構築または維持の場合、モデルの精度の向上と構造化された出力は、テストの検証とトラブルシューティングのオーバーヘッドを減らします。
オーケストレーションのコンテキストでは、複雑なパイプラインのブラウザベースのコンポーネントを自動化するための実用的で信頼できるツールを提供します。
データエンジニアは、データの検証やスクレイピングなど、手動のWebインタラクションをより自信を持ち、より高いレベルの最適化作業のための時間を解放することができます。
一方、セキュリティの専門家は、モデルの階層化された安全メカニズムのおかげで、監査およびインシデント対応演習でユーザーの行動をシミュレートするためのより安全な方法を獲得します。
これらの分野で、O3ベースのオペレーターは、機能アップグレードとリスク軽減フレームワークの両方を導入し、最新のテクニカルツールキットに実用的な追加になります。
毎日VBでのビジネスユースケースに関する毎日の洞察
上司を感動させたい場合は、VB Dailyがカバーしています。規制上のシフトから実際の展開まで、企業が生成AIで行っていることについて内部のスクープを提供するので、最大のROIの洞察を共有できます。
購読してくれてありがとう。こちらのVBニュースレターをご覧ください。
エラーが発生しました。

#OpenaiアップデートオペレーターはO3になり毎月200ドルのChatGPT #Proサブスクリプションをより魅力的にします