日本語版
最新ニュース
世界

Googleからのニュースが静かに届き、AIテストで記録的なスコアを獲得

少し前までは、このようなニュースの発表には、スポットライトが当てられ、ステージ上で興奮した開発者がいっぱいの壮観な記者会見が行われたはずです。しかし、今日では人工知能の開発のペースが非常に速いため、派手なプレゼンテーションを行う時間はまったくありません。 Google は、前バージョンのリリースからわずか 3 か月後に、これまでで最も先進的なモデルである Gemini 3.1 Pro を何の宣伝もなく世界にリリースしました。 一見目立たないこのステップは、明らかに略奪的な競争、特に 最近発売されたモデル Anthropic の Claude Sonnet 4.6 は、多くのユーザーの間で新しいリーダーとしての評判を獲得し始めています。彼はガジェットを開発者、アナリスト、プロダクト マネージャーに向け、たとえば、仕事を分担できる自律エージェントのチームを導入しました。 一方、Google によると、新しい Gemini のユーザーとして感じる最も根本的な変化は簡単に説明できるとのことです。 Gemini 3.1 Pro はより長く考えますが、より優れています。現在、このモデルは論理的推論がより強くなり、幻覚が大幅に減り、詳細な写真分析から作曲能力、高度なコード記述まで、幅広い新しいスキルをもたらしたと言われています。その主な魅力は、革新的な 3 レベルの推論システムであると考えられています。 🚨 Gemini 3.1 Pro - ワンショット WINDOWS 11 WEBOSこの 2…

Googleからのニュースが静かに届き、AIテストで記録的なスコアを獲得

1771718442
2026-02-21 12:02:00

少し前までは、このようなニュースの発表には、スポットライトが当てられ、ステージ上で興奮した開発者がいっぱいの壮観な記者会見が行われたはずです。しかし、今日では人工知能の開発のペースが非常に速いため、派手なプレゼンテーションを行う時間はまったくありません。 Google は、前バージョンのリリースからわずか 3 か月後に、これまでで最も先進的なモデルである Gemini 3.1 Pro を何の宣伝もなく世界にリリースしました。

一見目立たないこのステップは、明らかに略奪的な競争、特に 最近発売されたモデル Anthropic の Claude Sonnet 4.6 は、多くのユーザーの間で新しいリーダーとしての評判を獲得し始めています。彼はガジェットを開発者、アナリスト、プロダクト マネージャーに向け、たとえば、仕事を分担できる自律エージェントのチームを導入しました。

一方、Google によると、新しい Gemini のユーザーとして感じる最も根本的な変化は簡単に説明できるとのことです。 Gemini 3.1 Pro はより長く考えますが、より優れています。現在、このモデルは論理的推論がより強くなり、幻覚が大幅に減り、詳細な写真分析から作曲能力、高度なコード記述まで、幅広い新しいスキルをもたらしたと言われています。その主な魅力は、革新的な 3 レベルの推論システムであると考えられています。

🚨 Gemini 3.1 Pro – ワンショット WINDOWS 11 WEBOS

この 2 つの世代の違いは、この例でわかります

ところで、前回これを共有したとき、それは非常に困難だったので急速に広まりましたが、今ではそれが標準であり、エージェントシステムを使用すると、このモデルで何でもできます https://t.co/ZgAjyJDZ6n pic.twitter.com/pUMVn9XDSR

— チェタスルア (@chetaslua) 2026 年 2 月 19 日

著者らによると、人工知能はクエリについてどの程度「考える」かを自ら選択するようになり、時間と能力を節約できるようになるという。したがって、実際には、彼は簡単な質問を瞬時に処理しますが、複雑な質問の場合は、計算に数分を簡単に費やすことができます。

世界中のユーザーがさっそく新製品のテストを開始し、インターネット上には週半ばからさまざまなサンプルが溢れかえった。たとえば、Gemini 3.1 Pro は、単一のテキスト命令から、Windows 11 オペレーティング システムの完全に機能する模造品を生成できます。これはブラウザーで直接実行され、デスクトップ、ファイル エクスプローラー、カレンダー、明るさの設定が欠けていません。古いモデルでも同様のトリックを実行できましたが、新しいモデルの機能の変化は顕著です。

こちらもお読みください。Gemini は待っている間に無料で曲を作曲します。 Google の hoGemini を試してみました。待っている間に曲を再生してくれます。なぜビーバーを検閲するのか、そしてこれまで競合他社に比べてどのような点で遅れをとっているのでしょうか?

編集部では、Web アプリケーションやアニメーションを迅速に作成する機能もテストしました。チャットボットが受けた任務は、それほど広範囲にわたるものではありませんでした。 「誕生から成豚までの豚の生涯のさまざまな段階を示すインタラクティブなアプリを作成します。各段階について、それがどれくらいの期間続くのか、ブリーダーは何に注意すべきかを述べます。」 2 分以内に、上品でインタラクティブな Web サイトが目の前に完成し、各ステージをクリックしてエレガントに進むことができました。農業学生などの教材として最適です。

そして、新しい Gemini は競合他社とどう違うのでしょうか?権威ある ARC-AGI-2 ベンチマークでは、システムに保存されているチャットボットの知識だけでなく、まったく新しい論理問題を解決する実際の能力も測定され、モデルは 77.1% のスコアを達成しました。比較のために、Gemini の以前のバージョンは 31.1% で止まっていました。競合他社の Claude Opus 4.6 はこのテストで 68.8% に終わり、OpenAI の人気の GPT-5.2 はかなり遠くからリーダーの背中を見つめ、52.9% という結果になりました。

ウカスカ・ジェミニ-2ウカスカ・ジェミニ

このモデルは、GPQA ダイヤモンド科学的推論テスト (つまり、博士レベルの知識) でも優れており、Gemini 3.1 Pro は、外部ツールを一切使用せずに魔法の 95% の合格点に近づきました。

それでも、Google がすべてを勝ち取ったわけではありません。 AI がソフトウェア プログラムを完全に独立して作成、テスト、修正する、いわゆるエージェント コーディングの分野では、Anthropic の Opus 4.6 が依然としてリードを保っています。大量のデータをテーブルに処理する場合でも、他のものよりも優れています。

これらの結果から明らかなことが 1 つあります。考えられるすべての分野で競争なしで優位に立つ究極の AI ツールはまだ存在しません。モデルは常に改良されており、それぞれに特有の強みがあります。したがって、サブスクリプションを選択するときは、主に誰もがツールに何を期待しているかによって決まります。 Google の詳細な分析と複雑なコーディングが必要か、それとも競合他社の特殊な機能を好むか。

良いニュースは、事実上誰でも新しいモデルの品質をテストできることです。 Gemini 3.1 Pro は一般に公開されており、料金を支払っていないユーザーはベースの Gemini アプリケーションで直接見つけることができます。 Google AI Pro および AI Ultra プランの加入者は、より高い制限と、人気のある NotebookLM ツールとの統合などのより高度な機能を利用できます。このモデルは、Google AI Studio、Vertex AI、Android Studio プラットフォームを通じて企業や開発者に利用可能になります。


#Googleからのニュースが静かに届きAIテストで記録的なスコアを獲得

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。