日本語版
最新ニュース
科学&テクノロジー

Google、OpenAI o1に匹敵するGemini 2.0 Flash Thinkingを発表

日次および週次のニュースレターに参加して、最新の更新情報や業界をリードする AI に関する独占コンテンツを入手してください。もっと詳しく知る AI の状況を再定義するための最新の取り組みでは、 グーグルが発表した ジェミニ 2.0 フラッシュ思考、速度と透明性の両方で複雑な問題に取り組むことができるマルチモーダル推論モデル。 で ソーシャルネットワークXに投稿する、Google CEOのサンダー・ピチャイは、これを「これまでで最も考え抜かれたモデル:)」と書いています。 新しいモデルは、わずか 32,000 トークンの入力をサポートします (約 50〜60ページ相当のテキスト)、出力応答ごとに 8,000 個のトークンを生成できます。 Google AI Studio のサイドパネルでは、同社はこれが「マルチモーダルな理解、推論」、「コーディング」に最適であると主張しています。 モデルのトレーニング プロセス、アーキテクチャ、ライセンス、コストの詳細はまだ公開されていません。現時点では、Google AI Studio ではトークンあたりのコストがゼロと表示されています。 アクセスしやすく、より透明性の高い推論 OpenAI の競合他社の推論モデル o1 および o1 mini とは異なり、Gemini 2.0 ではユーザーがドロップダウン…

Google、OpenAI o1に匹敵するGemini 2.0 Flash Thinkingを発表

日次および週次のニュースレターに参加して、最新の更新情報や業界をリードする AI に関する独占コンテンツを入手してください。もっと詳しく知る

AI の状況を再定義するための最新の取り組みでは、 グーグルが発表した ジェミニ 2.0 フラッシュ思考、速度と透明性の両方で複雑な問題に取り組むことができるマルチモーダル推論モデル。

ソーシャルネットワークXに投稿する、Google CEOのサンダー・ピチャイは、これを「これまでで最も考え抜かれたモデル:)」と書いています。

新しいモデルは、わずか 32,000 トークンの入力をサポートします (約 50〜60ページ相当のテキスト)、出力応答ごとに 8,000 個のトークンを生成できます。 Google AI Studio のサイドパネルでは、同社はこれが「マルチモーダルな理解、推論」、「コーディング」に最適であると主張しています。

モデルのトレーニング プロセス、アーキテクチャ、ライセンス、コストの詳細はまだ公開されていません。現時点では、Google AI Studio ではトークンあたりのコストがゼロと表示されています。

アクセスしやすく、より透明性の高い推論

OpenAI の競合他社の推論モデル o1 および o1 mini とは異なり、Gemini 2.0 ではユーザーがドロップダウン メニューから段階的な推論にアクセスでき、モデルがどのように結論に達するかについてより明確で透明性の高い洞察を提供します。

Gemini 2.0 は、ユーザーが意思決定がどのように行われるかを確認できるようにすることで、AI が「ブラック ボックス」として機能することに対する長年の懸念に対処し、このモデル (ライセンス条件はまだ明確ではありません) を、競合他社が提供する他のオープンソース モデルと同等のものにします。

モデルの初期の簡単なテストでは、「Strawberry」という単語に含まれる R の数を数えるなど、他の AI モデルでは難しいことで悪名高いいくつかの質問に、モデルが正確かつ迅速に (1 ~ 3 秒以内に) 答えることができました。 (上のスクリーンショットを参照してください)。

別のテストでは、2 つの小数 (9.9 と 9.11) を比較する際、モデルは整数の分析から小数点以下の桁の比較まで、問題を体系的に小さなステップに分割しました。

これらの結果は、独立した第三者による分析によって裏付けられています。 LM アリーナは、Gemini 2.0 Flash Thinking をすべての LLM カテゴリでナンバーワンのパフォーマンス モデルに指名しました。

画像のアップロードと分析のネイティブ サポート

ライバルの OpenAI o1 ファミリをさらに改良し、Gemini 2.0 Flash Thinking はジャンプからの画像を処理するように設計されています。

o1 はテキストのみのモデルとして開始されましたが、その後、画像とファイルのアップロード分析を含むように拡張されました。現時点では、どちらのモデルもテキストのみを返すことができます。

によると、Gemini 2.0 Flash Thinking は現在、Google 検索との連携や、他の Google アプリや外部サードパーティ ツールとの統合をサポートしていません。 開発者向けドキュメント

Gemini 2.0 Flash Thinking のマルチモーダル機能により、潜在的なユースケースが拡張され、さまざまな種類のデータを組み合わせたシナリオに取り組むことが可能になります。

たとえば、あるテストでは、モデルはテキスト要素と視覚要素の分析を必要とするパズルを解決し、フォーマット間の統合と推論におけるその多用途性を実証しました。

開発者は、モデルを実験に利用できる Google AI Studio および Vertex AI を介してこれらの機能を活用できます。

AI 環境の競争が激化する中、Gemini 2.0 Flash Thinking は問題解決モデルの新時代の始まりとなる可能性があります。多様なデータタイプを処理し、目に見える推論を提供し、大規模に実行できるその能力により、OpenAI の o1 ファミリ以上に匹敵する推論 AI 市場の有力な競争相手としての地位を確立しています。

VB Daily を使用したビジネス ユースケースに関する毎日の洞察

上司に好印象を与えたい場合は、VB Daily がサポートします。規制の変更から実際の導入に至るまで、企業が生成 AI で何を行っているかに関する内部情報を提供します。これにより、ROI を最大化するための洞察を共有できます。

ご購読いただきありがとうございます。その他の VB ニュースレターはこちらからご覧ください。

エラーが発生しました。

#GoogleOpenAI #o1に匹敵するGemini #Flash #Thinkingを発表

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。