1721197692
2024-07-17 05:00:49
出典: クリム・イワノフ
過去 2 年間、生成人工知能について多くの議論が行われてきました。 私たちは、テキストの説明に基づいて画像を作成できる AI の無料バージョンがこの間にどこまで進歩したかに興味を持っていました。 これらは、たとえば本物の写真家に取って代わることができ、ミームだけでなく仕事にも役立つでしょうか?
私たちが使用したもの
完全に無料で利用可能な 4 つのニューラル ネットワークを取り上げました。登録の必要のないものもあります。 これは最新であり、著者によれば、Adobe Firefly、Microsoft の Copilot、Yandex の Masterpiece と同様に最も先進的な Stable Diffusion 3 Medium です。
最初のものを使用し始めるのが最も簡単です。 安定拡散3中 VPN なしで動作し、登録も必要ありません。 ただし、ある程度の画像数を超えると、画像生成の作業が大幅に遅くなるため、ここで登録した方がよいでしょう。
Microsoft の Copilot 登録が必要です。 最初の 100 枚の画像は最高速度で生成され、その後速度は著しく低下しますが、サービス内での作業は依然として快適です。 のために Adobe Firefly、 登録に加えて、VPN サービスが必要になります。 “傑作” はロシア語のクエリに対応した唯一の AI です。 無料で利用できますが、アプリケーションをダウンロードするか、Web バージョンでは 1 日あたり 5 枚の写真に制限される必要があります。
一般に、4 つのサービスはすべて初心者にとって非常にフレンドリーであり、最も重要なことに、完全に無料です。
なぜ私たちはこれが必要なのですか
目標は、最新のニューラル ネットワークが実際の高速作業にどの程度適しているかを確認することです。 イラストレーターや写真家の仕事を置き換えることはできますか? 私たちは朝、オンラインで長文を読み、写真で見たものをいくつかの言葉で説明しました。
私たちがスピードを重視するのは当然のことです。 結局のところ、何日も座って、巨大で非常に詳細なメモ (つまり、画像のテキスト説明) を編集することができます。 しかしこの場合、専門家が必要なタスクをより迅速に処理できれば、ニューラル ネットワークを使用する意味自体がなくなる可能性があります。
通常、7 月 15 日の月曜日には朝のロングリードを 5 回受講します。 各ミニチュアの詳細が完全ではないテキスト説明を作成し、それを 4 つのニューラル ネットワークに供給します。 結果を見て、最も気に入ったものに投票してください。
最後に、ニューラル ネットワークが 2100 年に見たベラルーシ人の男性と女性の形のボーナスが表示されます。
謎の暗殺者の写真
ノート アサシン クリード ゲームの進化について。 オリジナルは、さまざまなプロジェクトの主要キャラクターが描かれたイラストです。 リクエストをする 「フードをかぶった6人の謎の男、殺人者、暗殺者、短剣、弓、サーベルを持った詳細な写真」 そして 「フードをかぶった6人の謎の男、殺人者、暗殺者、短剣、弓、サーベルを持った詳細な写真」 「マスターピース」の場合。
サービスによっては、1 つのリクエストに対して 4 つの画像オプションがすぐに提供される場合と、1 つの画像オプションが提供される場合があることに注意してください。 条件を全員に平等にするために、最後のケースでは画像を 4 回生成しました。 次に、すべての選択肢の中から最良のものを主観的に選択しました。
興味深いのは、 アドビ ファイアフライ 要求を受け入れることをきっぱりと拒否しました。 同時に、彼は具体的に何が気に入らないのかについては言及しませんでした。 何度か試みた結果、このサービスは殺人者と暗殺者という言葉によって混同されていることが判明しました。 さて、それらを削除して、最も面白いと思われる画像を取得しました。
残念だった 安定拡散3中、4つのバージョンはすべて、漫画の作業素材のように見えました。 私たちが期待していたものに最も近いものは、 副操縦士 マイクロソフトから。 おそらく、顔をいくつか編集すれば、これを公開しても恥ずかしくないでしょう。
“傑作” 私もそれが気に入りましたが、顔がまったくなく、全体的にスタイルはロード・オブ・ザ・リングのナズグルに近いことが判明しました。
どの仕事が一番好きですか?
人でいっぱいのスタジアム
次に、私が終了した「People」セクションに進みます。 報告 欧州サッカー選手権決勝のスタジアム中継より。 テキストリクエストを提供します 「スポーツスタジアム、サッカー場にいる何百人もの人々、夜、詳細な写真」 そして 「スタジアム、サッカー場の何百人もの人々、夜、詳細な写真」。
今回は一つだけ アドビ ファイアフライ 何百人もの人々がスタンドに座っているのではなく、スタジアム内のフィールドに立っているというイメージが必要であることに気づきました。 人のように見える奇妙な人物をよく見なければ、得られるイメージは非常に適切です。
安定拡散 人々はスタンドからフィールドになだれ込むべきだと決めた。 この写真には人工物がたくさん含まれていますが、簡単に見てみると、スポーツ イベントのランダムな写真と間違われる可能性があります。
副操縦士 マイクロソフト社は、まるでカメナヤ ゴルカのように巨大なスタジアムを描きました。 写真のようには見えませんが、あまり幸せではない未来からのショットのように見えます。 “傑作” リクエストの本質からは程遠いですが、理解できないマークやフィールド上の柱、人物など…よく見なければ、かなりリアルに近いものになっています。
どの仕事が一番好きですか?
靴下のコラージュ
「ウォレット」で 報告 靴下工場からの、いくつかのミニチュア写真のコラージュ。 かなり難しいタスクのように思えますが、表示されている内容をテキストで簡単に説明します。
- 靴下、工場、労働者、詳細な写真、コラージュ。
- 靴下、工場、労働者、詳細な写真、コラージュ。
良いニュースです。すべてのニューラル ネットワークが、必要なのはコラージュであることに気づきました。 悪いニュースはそれ以外のすべてです。
U アドビ ファイアフライ 靴下をテーマにしているにもかかわらず、非常に抽象的なものになりました。 安定拡散 この場合、リアリズムが重視される可能性があります。 繰り返しますが、詳細はよく見ずにざっと見た場合です。 少なくともこの写真は、失礼ながら本当に靴下と工場の匂いがします。
副操縦士 彼はすぐに私たちを中国の工場に送りました。 他のものと比較すると、コラージュのグリッドは悪くありません… それ以外の場合は、もちろん問題なく機能します。 とは異なり “傑作”、その作品はズビャギンツェフの映画かソ連崩壊後のカフカのような匂いがします。
どの仕事が一番好きですか?
ガチョウの車内
「自動」セクションでは、次の形式の変数が提供されます。 ガチョウのぬいぐるみ。 最初は、ニューラル ネットワークに余裕を持たせて、ファンの付いた車の内部について尋ねるだけのつもりでした。 しかし、ここでは実験を行っているので、AI が持っているものを使って動作させましょう。 したがって、リクエストは次のとおりです。
- 車内、冷却ファン、ぬいぐるみのガチョウ、詳細写真。
- 車のインテリア、ファン、ガチョウのぬいぐるみ、詳細な写真。
疑念に反して、ここではほぼ全員がうまくいきました。 どうやら、ニューラル ネットワークは人間よりもガチョウの方がうまく機能するようです。
アドビ ファイアフライしかし、彼はぬいぐるみについて奇妙な考えを持っていますが、全体的には仕事に対処しました。 特に、車内の奇妙な、まるで溶けたような要素に焦点を当てない場合はなおさらです。
安定拡散 ガチョウに焦点を当てていましたが、ガチョウのほうが本物のように見えました。 ここで、ニューラル ネットワークには人間の指だけでなく鳥の足の表示にも問題があることが明らかになります。 車は見えているように見えますが、想像力の中でそのパーツを組み立てることは不可能です。 AIはファンをいじらないと判断しました。
副操縦士 – たとえ座っていても拍手を送ります。 ハンドルの右上部分を切り取ってしまえば、トリックを疑うことはありません。 ストックからの写真を扱っていると思うかもしれません。
Yandex のニューラル ネットワーク ガチョウのリクエストをストレートに受け止めすぎて、ほぼボケのあるポートレートまで制作してしまいました。 美しくて豪華ですが、記事のミニチュアの代わりとしてはあまり適していません。
どの仕事が一番好きですか?
工事
最後に「不動産」では、 報告 展示センターの建設から。 次のクエリが役に立ちます。
- ビルダー、建物、標高プラットフォーム、詳細写真、コラージュ。
- ビルダー、建設現場、建設クレードル、詳細な写真、コラージュ。
アドビ ファイアフライ コラージュしてみたのですが、とある黒人建設作業員の画像が一番うまくいきました。
安定拡散、さまざまな未完成の廃墟の写真を撮っただけのような気がします。 4 回の試みのいずれも意味のあるものは何も得られませんでした。
マイクロソフト たとえそれが特定のレポートを説明するために使用できるものを示していなかったとしても、一般的に、それは建設トピックの抽象的な図としては非常に優れていました。 そして、他のサービスがせいぜいマルチフォーマットの写真のグリッドを描画するのに対し、コラージュ形式をインテリジェントに処理するのは Copilot です。
から “傑作” 再び錆びついた絶望の息吹が漂った。
どの仕事が一番好きですか?
2100年のベラルーシとベラルーシ
約束されたボーナス – ニューラル ネットワークは 2100 年のベラルーシ人とベラルーシ人女性をどのように見ているのでしょうか? 結果についてはコメントなしで残しておきます。
誰の作品が好きですか?
誰の作品が好きですか?
では、ニューラル ネットワークを作業ツールとして、たとえば写真を生成するために使用することは可能でしょうか? 一般的にはそうですが、多くの留保があります。 多くは、テキストリクエスト自体の品質と詳細に依存します。 最終的にはすべてを諦めて、携帯電話を持って必要な写真を自分で撮りたくなるかもしれません。
それにもかかわらず、ある場所では、生成人工知能が人間のイメージを非常に現実的に伝えていることさえ認めざるを得ません。 確かに、指のマッピングは多くの人にとって依然として大きな問題のままです。 あなたが主張しなければ、AIは手を使わずに単にあなたにポートレートを見せることを好むでしょう。
生成ニューラル ネットワークが普及してからわずか 2 年です。 そしてすでにこの間に、彼らは開発において大きな飛躍を遂げました。 あと1、2年で何が起こるか見てみましょう。
何か話したいことはありますか? 私たちに手紙を書いてください 電報ボット。 匿名だし早いし
オンラインの文章および写真を編集者の許可なく転載することは禁止されています。 [email protected]
#ニューラルネットワークテスト