1743407930
2025-03-31 07:36:00
更新(3月31日):Googleは、Gemini 2.5 Proも自由に使用できることを発表しました。先週、上級ユーザーの支払いのみがGoogleの最新モデルにアクセスできました。
Gemini 2.5 Proは、GeminiアプリとGoogle AI Studio内のLLMSの1つとして選択可能になりました。
Googleは、実験バージョンのGemini 2.5 Proを導入することにより、Gemini人工知能モデルのフラッグシップシリーズを更新していることを発表しました。
Googleによると、Gemini 2.5 Proは最もインテリジェントなモデルです。 「思考」能力があります。将来のすべてのGemini 2.5モデルは、いわゆるThinkモデルになります。これらは、回答を提供する前に、タスクを複数のステップに分割し、これらの手順を論理的に通過することができます。同社は、これがパフォーマンスの向上とより高い精度につながることを示しています。
Google Deepmindの最高技術責任者であるKoray Kavukcuogluが説明します シリコンアングル AIシステムの推論能力は、単なる分類と予測を超えていること。また、情報の分析と論理的な結論の描画、コンテキストとニュアンスの検討、実証された決定の行為も含まれます。
この推論能力は、Gemini 2.0 Flash Thinking Experimental AIモデルで最初に導入され、12月に同社が立ち上げました。同社は、このモデルを開発するために強化学習や考え方の促しなどの技術を使用しました。
Gemini 2.0 Flash Thinkingを使用すると、ユーザーはプロンプトの入力中にボタンをクリックすることでこの思考機能をアクティブにすることができます。その後、モデルは推論し始めました。また、ユーザーがどのように結論に達したかをユーザーが確認できるように、その思考プロセスを示しました。
Googleは思考の指定を追加しなくなりました
同社によれば、ニューラルトレーニングのおかげで、Gemini 2.5 Pro Experimentalは基本モデルよりも高いレベルのパフォーマンスに達しました。 Googleは、それを複雑なタスクの最も高度なモデルと見なしています。人間の好みに基づいて、Lmarenaランキングで最高のスコアを達成しました。
このモデルは、人類の最後の試験で18.8%を獲得しました。これは、人間の知識と推論能力に焦点を当てた数百人の専門家によって設計されたデータセットです。それに比べて、OpenaiのO3-Miniはここで14%、Deepseek R1 8.6%を獲得しました。 O3-MINIとR1はどちらも、Gemini 2.5 Pro Experimentalと同様に、複雑な推論を処理できる概念モデルでもあります。
Kavukcuogluは、同社がコーディングのパフォーマンスに焦点を当てており、Gemini 2.5はバージョン2.0と比較して大幅な前進であり、パイプラインのさらに改善があることを示しました。
モデルの新しい機能を実証するために、Googleの研究者は、HTML、CSS、JavaScriptの恐竜と1つのプロンプトに基づいてエンドレスランナービデオゲームを生成するように依頼しました。モデルはこれを一度に完了しました。
200万トークンへの拡張
実験的なGemini 2.5 Proには、100万のトークンのコンテキストウィンドウがあります。つまり、非常に大きなドキュメント、オーディオ、ビデオファイル(約150万語)を処理できます。 Googleは、このウィンドウを200万トークンに拡張したいことを示しています。
大規模なコンテキストウィンドウと高性能のおかげで、Gemini 2.5 ProはAIエージェントに強力な根拠を提供します。これにより、大規模なデータセットを処理し、複雑な問題により効果的に取り組むことができます。 AIエージェントは自律的に動作して計画するため、モデルの改善された推論能力は、データを理解し、ツールを使用してタスクを実行する能力を大幅に向上させます。
開発者とビジネスユーザーは、Google AI StudioのGemini 2.5 Proを既に実験することができ、Gemini Advancedのユーザーはデスクトップとモバイルでモデルを直接選択できます。今後数週間で、AIを構築および展開するためのGoogleの管理された機械学習プラットフォームであるVertex AIのユーザーは、モデルにアクセスできます。
#GoogleはGemini #Proに無料でアクセスできるようになりました