プロンプト:16:9の比率で路上でスーツを着ている犬の現実的なカラフルな画像を生成できますか
Sabrina Ortiz/Zdnetによるスクリーンショット
Openaiは、Dall-Eモデルでテキストからイメージへの生成の流行を開始した可能性がありますが、以前の栄光の日以来、AI会社の提供は、はるかに有能な画像モデルによってラップされています。その結果、Openaiが最新かつ最大のGPT-4Oイメージ生成モデルをリリースしたとき、私は懐疑的でした。それをテストした後、私は心を完全に変えました。
はじめる
Dall-Eが最初に発売されたとき、それはそのスタンドアロンのウェブサイトに住んでいました。それ以来、ChatGptに移動しました。この動きには、すでに何か他のものについてチャットしているのと同じインターフェイスで必要な画像をAIチャットボットに尋ねる機能など、多くの利点があり、それによって一定のコンテキストスイッチングの必要性が排除されます。
GPT-4O画像生成のリリースにより、Openaiはこの便利な形式を保持し、有料加入者向けにデフォルトの画像ジェネレーターをDall-EからGPT-4Oに切り替えました。その結果、ChatGpt Plusアカウントから新しい画像の作成を開始するのは非常に簡単でした。私がしなければならなかったのは、私が見たいもののためにプロンプトを入力し、それがそれらを生成しました。ユーザーは、SORAインターフェイスからアクセスすることもできます。
また:Openaiのソラを使用して見事なAIに生成されたビデオを作成する方法
無料のユーザーである場合は、画像を生成することもできます。発売時、このモデルは無料のユーザーを含むすべてのユーザーに来ることが発表されましたが、その後、Openai CEOのSam Altman 発表 無料の層への展開が「しばらくの間遅延」になる1日後、 作る 1週間後に再びユーザーを再び無料で利用できます。
ただし、無料バージョンで試してみると感銘を受けた場合、GPT-4oの使用をアクティブにする唯一の方法は、ショートカット「/作成画像」でタイピングすることです。 「XYZの画像を作成する」などのリクエストを入力するだけで、Dall-Eモデルがデフォルトであり、品質が大幅に低い写真をレンダリングします。 Openaiは明示的に制限を記載していませんが、無料アカウントから3つの画像を生成した後、毎日の制限に達しました。したがって、ChatGpt Plusは、画像生成へのアクセスを高めるための適切なオプションです。
画像
あなたが待っていた瞬間 – 画像。プロンプトを挿入した後、AIは1分未満で生成を出力します。このプロセスには以前よりも少し時間がかかりますが、画像は待つ価値があり、多くの詳細、テクスチャ、リアリズム、さらにはテキストの正確さを提供します。説明する代わりに、以下に例を掲載して、自分で確認できるようにします。
プロンプト:カメレオンの現実的なイメージを、16:9の比率でナショナルジオグラフィックにあるかのように撮影することができますか?
sabrina ortiz/zdnet byChatgpt
プロンプト:「このモデルは非常に優れているため、テキストと手を正しくすることさえできるほど良いラップトップの画像を生成できます。これは通常、AIモデルにとって大きな課題です」と、16:9の比率でキーボードを入力しますか?
sabrina ortiz/zdnet byChatgpt
プロンプト:カメラを見て微笑んで、DSLRで撮影されたタイムズスクエアの群衆の中の女性のクローズアップの現実的な写真を生成できますか?
sabrina ortiz/zdnet byChatgpt
上記のように、画像ジェネレーターは、高品質で現実的な画像をプロンプトに順守し、配信するという素晴らしい仕事をしています。ただし、AIモデルをテストする場合、真のパフォーマンスメトリックの1つは、市場の競合他社と比較する方法です。これを適切に指標にするために、Midjourney、Google’s Imagen 3、Adobe Fireflyなど、すべての主要なAI画像ジェネレーターでテストしたのと同じプロンプトを生成させました。
プロンプト:木に腰掛けた活気に満ちた現実的なハチドリの画像を生成できますか?
sabrina ortiz/zdnet byChatgpt
その他の注目すべき機能
画像の品質はおそらくモデルの最大の勝利の1つですが、他の利点もあります。最大の1つは、チャットボットのインターフェイスに住んでいることです。これにより、シンプルな自然言語プロンプトで世代を簡単に調整できます。また、チャットボットには、あなたがちょうど尋ねたもののコンテキストがあるため、画像の構築においてそれを考慮することができます。
Sabrina Ortiz/Zdnetによるスクリーンショット
また、参照画像をアップロードしてから、ChatGptに別のバージョンを作成するか、新しいバージョンの要素として使用することもできます。たとえば、Altmanの新しいX投稿に見られるように、セルフィーとして入力し、アニメスタイルで生成することができます。
私のPFPを変更しましたが、多分誰かが私をより良いものにするでしょう
– サム・アルトマン(@sama) 2025年3月26日
これらのカスタマイズ機能はすべて、クリエイティブにとって非常に強力な製品になります。クリエイティブは、透明なバックグラウンドでレンダリングされることを要求したり、16進コードやロゴなどのブランドスタイルのガイドを組み込んだりすることもできます。
アルトマンといえば、私は彼がパーティーの帽子をかぶっているイメージを生成することができました。新しいモデルには、ユーザーが創造的な自由に寄りかけることを可能にすることを目的とした、新しいモデルにははるかにゆるい保護措置があるため、私はそうすることができました。モデルを発表したブログ投稿では、「ヌードとグラフィックの暴力に関する特に堅牢なセーフガード」など、実際の人々がコンテキストにいるときに作成できるものを制限することが指摘されています。
sabrina ortiz/zdnet byChatgpt
全体
全体として、GPT-4Oイメージジェネレーターは、Dall-Eモデルに大きな勝利であり、おそらく私がテストした多くの人の中で大きな勝利です。月額20ドルの価値はありますか?高品質の画像生成に興味がある場合は、Adobe FireflyやGoogle’s Imagen 3など、非常に有能な無料のバージョンがまだあります。
また、最高のAI画像ジェネレーター:テストおよびレビュー
そうは言っても、更新された画像生成機能は現在展開されており、無料のユーザーを含むすべてのユーザーがアクセスできます。ただし、無料のユーザーはショートカット「/作成画像」を入力する必要があります。そうしないと、システムがデフォルトで低品質のDALL-Eモデルになります。
頻繁にChatGPTユーザーである場合、ChatGPT Plusへのアップグレードは非常に魅力的になります。 Openaiの最新かつ最高のチャットボット機能のすべてにアクセスでき、高品質の画像とビデオ生成はすべて月額20ドルで、特に市場の他の製品を考慮して、悪い取引ではありません。たとえば、Midjourneyのサブスクリプションは月額10ドルから始まり、画像生成のみを提供します。
#ChatGptの新しい画像ジェネレーターは私の期待を打ち砕きました #そして今それは無料で試すことができます