日本語版
最新ニュース
世界

Google、開発者向けにより忠実度の高い画像生成モデルをリリース

Google は、Gemini 3 Pro 上に構築されたより忠実度の高い画像生成モデルである Nano Banana Pro をリリースしました。開発者は、Google AI Studio と Vertex AI の有料プレビューを通じて利用できるようになりました。この新しいモデルは、数か月前にリリースされた Nano Banana の機能を拡張し、改善されたテキスト レンダリング、堅牢な世界知識、最大 14 個の標準入力を 1 つの洗練された広告にブレンドする機能などの高度な機能を提供します。 Google によると、Gemini 3 Pro Image は Text to Image AI ベンチマークで優れたパフォーマンスを示し、プロの制作に適した 2K および 4K 解像度の高解像度出力を実現します。このリリースは…

Google、開発者向けにより忠実度の高い画像生成モデルをリリース

1772925802
2026-03-07 23:11:00

Google は、Gemini 3 Pro 上に構築されたより忠実度の高い画像生成モデルである Nano Banana Pro をリリースしました。開発者は、Google AI Studio と Vertex AI の有料プレビューを通じて利用できるようになりました。この新しいモデルは、数か月前にリリースされた Nano Banana の機能を拡張し、改善されたテキスト レンダリング、堅牢な世界知識、最大 14 個の標準入力を 1 つの洗練された広告にブレンドする機能などの高度な機能を提供します。 Google によると、Gemini 3 Pro Image は Text to Image AI ベンチマークで優れたパフォーマンスを示し、プロの制作に適した 2K および 4K 解像度の高解像度出力を実現します。このリリースは Adobe や Figma などのクリエイティブ プラットフォームにも拡張されており、Google の新しいエージェント開発プラットフォームである Antigravity にも統合されており、コーディング エージェントが詳細な UI モックアップを生成できるようになります。

Gemini 3 Pro イメージにより、忠実度の高い視覚制御が可能になります

Google DeepMind の新しい画像生成モデルは、スタジオ品質のビジュアルを求める開発者が利用できる忠実度と制御を再定義します。 Gemini 3 Pro 基盤上に構築された Nano Banana Pro は、単純な画像作成を超えて視覚要素の正確な操作を提供し、詳細かつ正確な出力を必要とするアプリケーションにとって大きな飛躍を約束します。 Google DeepMind のプロダクト マネージャーである Alisa Fortin 氏と Naina Raisinghani 氏は、このリリースについて詳しく説明し、Gemini API を通じて「インテリジェントでマルチモーダルなアプリケーションの新しい波」を構築するためのツールとして位置づけています。モデルの機能は美的改良を超えて拡張されます。 Gemini 3 Pro Image は、テキスト レンダリングのより高い精度と堅牢な世界知識を解放します。これは、明瞭さと事実の正確さを要求するアプリケーションにとって重要な進歩です。これは、部分的には、Google 検索と統合するモデルの機能によって実現され、リアルタイム データを取得して、生成された画像に組み込むことが可能になります。

Google 検索とのこの統合は、複雑な生物学的図や歴史的に正確な地図など、正確な表現を必要とするアプリケーションにとって特に価値があります。 2K および 4K 解像度が利用できるため、出力はプロの制作環境の基準を満たすことができます。このシステムでは、照明、カメラアングル、フォーカス、カラーグレーディングなどの画像物理をきめ細かく制御できるため、プロ品質の出力を作成できます。一貫して最大 5 人の人物に似せたり、6 つの高忠実度ショットを統合したり、14 もの標準入力を 1 つの洗練された広告にブレンドしたりすることができます。

改善されたテキストレンダリングと多言語画像ローカリゼーション

現在のテキストから画像への人工知能モデルは、生成された画像内で読みやすいテキストを正確にレンダリングするのにしばしば苦労し、そのテキストを別の言語に翻訳するように求められた場合にはなおさらです。ただし、Google がリリースした新しいモデルである Gemini 3 Pro Image は、これらの制限を明らかに改善しています。 Gemini 3 Pro Image は「ロジックと言語の処理に優れ、画像に組み込まれた明確で正確なテキストを提供します。」この進歩は、単に視覚的に魅力的な画像を作成するだけでなく、プロフェッショナルなアプリケーションに適した機能資産を生成することにもつながります。また、マーケティング資料、教育コンテンツ、その他多数のアプリケーションを開発するための理想的なソリューションでもあります。 Google の開発者は、画像生成とローカリゼーション ロジックの間の障壁を効果的に取り除き、元の芸術的なスタイルとレイアウトを維持しながら、画像間の生成を使用して、メニュー、看板、文書などの画像内のテキストを簡単に翻訳できるようにしました。

この機能のデモンストレーションでは、「英語テキストのフランス語への正確な翻訳とレンダリング」を紹介し、多言語のマーケティング資料や教育コンテンツを簡単に作成できる可能性を強調しています。単純な翻訳を超えて、膨大なナレッジ ベースに接続し、有効にすると Google 検索との統合を利用できるモデルの機能により、生成されたアセットの事実の正確性が高まります。これは、生物学的図や歴史的地図など、正確な視覚的表現を必要とするアプリケーションに特に影響を与えます。

Gemini 3 Pro Image では、画像生成とローカリゼーション ロジックの間の障壁を取り除きました。

Google 検索のグラウンディングにより事実の画像生成が強化

#Google開発者向けにより忠実度の高い画像生成モデルをリリース

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。