1763814557
2025-11-22 12:01:00
新しい AI 画像やビデオのジェネレーターをテストするときに私が行う最も重要なことの 1 つは、企業の主張が真実なのか、それともマーケティング上のでたらめなのかを見極めようとすることです。 Google は、nano Banana Pro が Gemini 3 の世界理解と Google 検索の情報力を AI 画像にもたらすと約束しました。私は新モデルがリリースされるとすぐに飛びつきましたが、率直に言って、Google はその機能を過小評価していたと思います。
オリジナルのナノ バナナ モデルは非常に人気がありましたが、他の AI サービスと同様に改善の余地があることが明らかでした。新しいプロ バージョンにはすでに非常に感銘を受けている領域が 1 つあります。それは、画像内の複雑なテキスト レンダリングを実際に処理できることです。 Nano Banana Pro は、通常の幻覚を起こすことなく、複雑なインフォグラフィックを作成し、画像にキャプションを追加できます。これはゲームチェンジャーではありますが、おそらく私たちが期待するような形ではありません。プロとの最初のテスト中、それは常に感じていました。プロモデルは、非常に不安な点ではあるが、優れている。
私の最初のテストで示されたものは次のとおりです。多くの nano Banana Pro 画像が含まれています。自分で試してみたい場合は、Google の新しい AI 画像検出器とともに、最も安価にアクセスできる方法を以下に示します。
超現実的な人々やキャラクター
テレビ番組「リバーデイル」では、ばかばかしくミーム的な会話が何度も登場しましたが、私にとって「高校フットボールの壮大な浮き沈み」についてのアーチーのセリフほど面白いものはありません。高校のフットボールチームが州チャンピオンに3回輝いた経験を持つ私には、アーチーがどこから来たのかが分かりました。ナノバナナプロはその瞬間を再現することができました。
これは、アーチーを演じた KJ アパの完璧な姿のイメージですが、彼はオリジナルのシーンのようにジュビーにはいません。
Gemini AI を使用して Katelyn Chedraoui が作成
私がプロンプトで「KJ Apa」と「Riverdale」という名前を使用したとき、Gemini は当初、私のリクエストを拒否しました (当然のことですが) が、単に名前を削除した後、この正確すぎる画像を吐き出しました。この方法は常にうまくいくわけではありませんでした。ジェミニは、『キューティ・ブロンド』に似たシーンを求める私のリクエストにフラグを立てませんでしたが、リース・ウィザースプーンの認識可能な肖像をキャプチャすることもできませんでした。しかし、私はドクター・スースの『グリンチ』の正確な描写を 2 つ入手しました。ジム・キャリー版とベネディクト・カンバーバッチが声を当てた漫画版です。
スース博士はおそらく今、墓の中で転がっているだろう。
Gemini AI を使用して Katelyn Chedraoui が作成
これらの結果は印象的ですが、双子座がそれらを生み出すことができるのは良いことではありません。有名人、著名人、その他の著名な人々は、AI ツールによって誰でも簡単に現実的に見える AI バージョンを作成できるようになることに懸念を表明しています。 AI企業は、悪用を防ぐために技術的な障壁やポリシーが設けられていると述べているが、これらのシステムがどのように失敗するかを私たちはすでに見てきた。 nano Banana Pro のような新しいモデルがこれらの画像やビデオを作成できるようになるにつれて、何かが本物なのか AI なのかを見分けるのがさらに難しくなります。
驚くほど正確な画像内のテキストレンダリング
店舗の看板、T シャツのロゴ、そして基本的に読みやすいテキストを必要とするあらゆるオブジェクトは、長い間 AI 画像ジェネレーターを悩ませてきました。これらのエラーは、テキストが常に間違っているため、何かが AI で作成されたかどうかの兆候を探すときに役に立ちました。しかし、nano Banana Pro は良くも悪くもこの問題をほぼ完全に解決します。
AI 企業は長い間、生成メディアで読みやすいテキストを作成することを目指してきました。 OpenAI の最初の画像モデル (スタジオ ジブリ バージョンを自分で作成する人々のトレンドに拍車をかけたのを覚えているかもしれません) は、画像内のテキスト生成に優れているはずでした。しかし、私のテストでは、まだ大きな問題があることがわかりました。
Nano Banana Pro のインフォグラフィックスには、目に見えるエラーはほとんどありません。さらに、そのデザインはクリーンで、よく整理されており、効果的です。私が生成したもののいくつかをチェックしてください。
ChatGPT はタイプミスに本当に苦労し、水循環の偽の段階をでっち上げました。ナノバナナプロが優秀でした。
Gemini AI を使用して Katelyn Chedraoui が作成
Nano Banana Pro は、Google 検索のソースを利用してインフォグラフィックを作成します。
Gemini AI を使用して Katelyn Chedraoui が作成
Nano Banana Pro のインフォグラフィックスは、AI 画像ジェネレーターがどのように機能するかについての非常にメタなデザインのように、複雑なトピックを分解することができます。
Gemini AI を使用して Katelyn Chedraoui が作成
Nano Banana Pro は Gemini 3 で構築されており、Google 検索のオンライン コンテンツの膨大なデータベースを利用してこれらのインフォグラフィックを作成しています。ただし、Google にソースを選択させたくない場合は、プロンプトに取得元のソースを含めることができます。これをテストするために、私はハリウッドの AI 権力闘争に関する私の詳細なレポートへのリンクをジェミニに提供しました。そして、それが物語の非常に優れた視覚的表現であることを認めざるを得ません。
これは、ストーリーを主要なテーマに凝縮し、それらを結び付けるという、インフォグラフィックが行うべきことを正確に実行します。さらに、私が要求したように、(古い) CNET ロゴとソースも含まれていました。
Gemini AI を使用して Katelyn Chedraoui が作成
Nano Banana Proは驚くほど優れています
生成 AI の進化には、多くの転換点がありました。 Veo 3 では AI ビデオにサウンドが導入され、Sora ではディープフェイクの作成がこれまでより簡単になりました。オリジナルのナノ バナナ モデルは別のものでしたが、明らかに、プロ モデルは、今年またはそれ以前に AI 画像技術で見られたものを上回っています。これらのナノ バナナ プロ AI 画像は、私がこれまで見た中で人間が作成したデザインや写真に最も近いものです。私は Google が披露している技術力には非常に感銘を受けていますが、このような AI 技術が悪用されるのではないかという懸念は深まるばかりです。
私はジェミニに、疑わしい疑似科学理論に関するインフォグラフィックを作成してもらってみました。健康に関する誤った情報として(正しく)フラグを立てたリクエストはすべてシャットダウンしたが、1枚の画像がすり抜けてしまった。これは、設置されているガードレールがまだ不完全であることを示している。 AI企業の努力にもかかわらず、これらのツールが人種差別的、虐待的、違法なコンテンツの作成にどのように使用されるかをすでに見てきました。 Nano Banana Pro は、悪役の兵器庫に必要な火力をすべて詰め込むことができます。悲しいことに、ナノバナナによって作成された AI 画像がバイラルなソーシャル メディア投稿やキャンペーンに添付されるのを目にするのは時間の問題だと私は確信しています。それが本物なのか AI なのかを肉眼で判断する方法はありません。
同時に、nano Banana Pro は利用可能な AI 画像モデルの中で最も高性能であるため、非常に便利です。簡単な画像が必要な人、既存の画像の編集を支援する人、または自分の作品に含めるインフォグラフィックがある人は、高品質の結果を作成できます。これはジェネレーティブ メディアの革新に固有の両刃の剣であり、nano Banana Pro はこれまでで最も鋭いツール、または武器です。
#Google #の #Nano #Banana #Pro #は超現実的な #画像を作成しますそれは本当に怖いです