1738582270
2025-02-03 00:00:00
Openaiは新しいものを発表しています あなたは「エージェント」を持っています 人々が詳細な複雑な研究を使用して行うのを支援するように設計されています chatgpt、同社のAI搭載のチャットボットプラットフォーム。
適切には、ディープリサーチと呼ばれています。
Openaiは言った ブログ投稿 この新しい能力は、「金融、科学、政策、工学などの分野で集中的な知識を行う人々のために設計されたものであることを日曜日に発表しました。また、「車、電化製品、家具などの慎重な調査が必要な購入が必要な購入」を作成する人にとっては、有用である可能性があると同社は付け加えました。
基本的に、CHATGPT Deep Researchは、簡単な答えや要約を必要とするだけでなく、複数のWebサイトやその他のソースから情報を熱心に検討する必要があるインスタンスを対象としています。
Openaiは、今日のChatGPT Proユーザーが月に100のクエリに制限し、Plusとチームユーザーのサポートが次にエンタープライズが続くために、深い調査を利用できるようにしていると述べました。 (Openaiは今から約1か月後にプラスロールアウトをターゲットにしていると同社は述べており、有料ユーザーのクエリ制限はまもなく「大幅に高く」なければなりません。)これはジオターゲットの打ち上げです。 Openaiには、英国、スイス、欧州経済圏のChatGptの顧客と共有するリリースタイムラインがありませんでした。
ChatGpt Deep Researchを使用するには、ファイルまたはスプレッドシートを添付するオプションを使用して、作曲家の「ディープリサーチ」を選択してからクエリを入力するだけです。 (これは今のところWebのみのエクスペリエンスであり、モバイルとデスクトップアプリの統合が今月後半に登場します。)深い調査には、質問に答えるのに5〜30分かかる可能性があります。 。
現在、ChatGpt Deep Researchのアウトプットはテキストのみです。しかし、Openaiは、埋め込み画像、データの視覚化、およびその他の「分析」出力をすぐに追加するつもりであると述べました。また、ロードマップには、「サブスクリプションベース」や内部リソースなど、「より専門的なデータソース」を接続する機能があります。
大きな問題は、ChatGpt Deep Researchがどれほど正確であるかということです。結局のところ、AIは不完全です。それはしやすいです 幻覚およびその他のタイプのエラー それは、「深い研究」シナリオで特に有害である可能性があります。それがおそらく、OpenaiがすべてのChatgptディープリサーチ出力が完全に文書化され、明確な引用と概要があると言った理由です。 [the] 考えて、情報を簡単に参照して確認することができます。」
審査員は、これらの緩和がAIの間違いと戦うのに十分であるかどうかについて出ています。 chatgpt、chatgpt検索のopenaiのAI搭載のWeb検索機能、まれではない 失望を作り、質問に対して間違った答えを与えます。 TechCrunchのテストでは、そのChatGPT検索が見つかりました それほど有用でない結果が生成されました Googleよりも特定のクエリを検索します。
Deep Researchの精度を強化するために、Openaiは使用しています 最近発表されたO3「推論」AIモデルの特別バージョン これは、「ブラウザとPythonツールの使用を必要とする現実世界のタスク」に関する強化学習を通じて訓練されました。強化学習は、本質的に試行錯誤を介してモデルを「教え」、特定の目標を達成します。モデルが目標に近づくと、理想的には、今後のタスクを改善する仮想「報酬」を受け取ります。
Openaiは、このバージョンのO3は「Webブラウジングとデータ分析に最適化されている」と述べ、「インターネット上の膨大な量のテキスト、画像、PDFを検索、解釈、分析するための推論を活用し、情報への反応で必要に応じてピボットします遭遇します。」モデルは「ユーザーが使用したファイルを閲覧することもできます」と同社は述べ、「グラフをプロットして繰り返します。 [a Python] ツールは、その応答にWebサイトから生成されたグラフと画像の両方を埋め込み、そのソースからの特定の文または文章を引用します。」

Openaiは、ChatGpt Deep Researchを使用してテストしたと述べました 人類の最後の試験、さまざまな学術分野での3,000を超える専門家レベルの質問を含む評価。 Deep Researchの動力を供給するO3モデルは26.6%の精度を達成しましたが、これは成績が失敗したように見えるかもしれませんが、人類の最後の試験は、モデルの進歩よりも先を行くために他のベンチマークよりも厳しいように設計されていました。 Openaiによると、Deep Research O3モデルは ジェミニ思考 (6.2%)、 Grok-2 (3.8%)、およびOpenai自身 GPT-4O (3.3%)。
それでも、Openaiは、ChatGpt Deep Researchには制限があり、間違いを犯し、誤った推論を行うことがあると述べています。深い研究は、権威ある情報を噂と区別するのに苦労する可能性がある、と同社は言った、そしてそれが何かについて不確かなときに伝えることができないことが多い。
生成AIが学生に与える影響を心配している人や、オンラインで情報を見つけようとしている人にとっては、このタイプの詳細で適切に引用された出力は、引用のない一見シンプルなチャットボットの概要よりも魅力的に聞こえるでしょう。ただし、ほとんどのユーザーが実際に出力を実際の分析とダブルチェックに導くかどうか、または単にそれをよりプロフェッショナルなテキストとしてコピーパスティで扱うかどうかを確認します。
そして、これがすべておなじみのように聞こえるなら、実際にはGoogle 同様のAI機能を発表しました まったく同じ名前で2か月前。
#Openaiはディープリサーチの新しいChatGPTエージェントを発表します