1729753164
2024-10-24 06:08:00
最近では誰でもあらゆるものの画像を作成できます。保留中、無料または数ペニーで、事実上あらゆるスタイルで。それはおそらく史上最大の視覚芸術の民主化です。彼女は研究者たちに注釈付きの写真を大量に撮影させ、それらをニューラル ネットワークに入力させることから始めました。
「これはおそらく、これまでに起こった史上最大の盗難だと思います」とアーティスト、デザイナー、インストラクターのレンカ・ハモショヴァ氏は信じています。彼は、人工知能に基づく画像生成プログラムが、著者の許可なしにデータに基づいてトレーニングされたという事実をほのめかしました。世界中で運行されています 一連の訴訟 この方法でニューラル ネットワークをトレーニングし、商用利用を提供している企業と協力してください。
(記事には厳選された箇所のみが掲載されています。全内容については、ポッドキャストを音声またはビデオ バージョンで聞いてください。特にビジュアル アートに関するこのエピソードについては、すべてのツールの例が含まれているため、ビデオを視聴することをお勧めします)言及された。)
写真: Somepalli 他、2022、Arxiv
上は安定拡散によって生成された画像のサンプルで、下はトレーニング データ内の対応する画像です。
「その一方で、もう後戻りはできないと感じています」とハモショバ氏は付け加えた。 「こぼれたミルクで泣いても無駄だよ。」
彼女自身もグラフィック デザイナーとして、画像を生成するニューラル ネットワークはアーティストの注目に値するとすでに 2018 年に判断していました。「それは急速に発展するだろうと気づきました。グラフィック デザイナーとしてこれらのテクノロジーに従わないのは、プロとしての自殺行為です。」彼女はそのときから、これらの AI ツールの創造的な使い方を研究し始めました。
発電機の驚異的な進歩
のようなプロジェクト スタイルGAN (存在しない人間の顔を生成する) または ガウガン (フォトリアリスティックな風景の生成) は、画像を生成するためのニューラル ネットワークのほとんど魔法のように見える可能性を示しました。しかし、この革命は、OpenAI が 2022 年の初めに披露した DALL-E 2 ツールによってもたらされました。このツールは、事実上あらゆるスタイルの画像を生成でき、ソース画像では決して結合されなかったオブジェクトを結合することさえできました。
写真: OpenAI
さまざまなスタイルのテディベアのサンプル。当時比較的無名だった OpenAI 社が、2022 年の春に DALL-E 2 ジェネレーターの機能を発表しました。
「それらの最初の写真は、私たちが美術史で学んだものと似ていました。たとえば、ぬいぐるみの電話の写真、さまざまな素材の組み合わせ、または物理法則に違反するものです」とハモショバ氏は、これらの例が興味深い理由を説明します。彼女によると、人々は通常、発電機でさまざまないたずらを試みるが、最初に思いついたのは空飛ぶユニコーンだったという。一方、私は、「砂漠にある現実的なサラダテント」というプロンプト (指示) を使ってテストすることがほとんどです。
写真: コラージュ: Pavel Kasík、Seznam Správy、AI ビジュアリゼーション
砂漠のテント (FLUX、Midjourney、Imagen 3 ジェネレーター)。
しかし、ジェネレーターは最初のバージョンから大きく前進しました。 Midjourney ジェネレーターの最初のバージョンと 6 番目 (これまでのところ最新のもの) を比較すると、これがはっきりとわかります。私たちは皆に同じプロンプトを与えます。青い鳥が枝に止まっており、望遠レンズを使用して遠くから接写した写真です。
最初の 3 つのバージョンはより抽象的な試みですが、4 つ目は突然それと認識でき、5 つ目と 6 つ目はすでに写真から区別できません。
リスクと可能性
私たちは 2024 年の初めに、ほとんどの人が実際の写真から生成された画像を認識できなくなることを実験的に検証しました。テストをまだ記録していない場合は、それを繰り返すことができます。
写真からAIを知っていますか?

人々の平均成功率はわずか 54% であり、これは無作為の推測に非常に近いものでした。一部の画像では、成功率がさらに低くなりました。そして、99%の人がテストで5つ以上間違えました。実際には、これは、未知の情報源からの写真をもはや信頼できないことを意味すると思います(これはそれほど新しいことではありません)。
誰もが視覚的に自分を表現できるようになりました
しかし、明るい面についても話します。私も含めて、これまで筆や鉛筆にあまり忍耐力がなかった人でも、今では自分のアイデアを驚くほど高品質な形で視覚的に実現できるようになりました。 「それは創造性の民主化と呼ばれることもあります」と、AI ツールの使用に関する講演を行っているハモショバ氏は説明します。 「私の観点からすると、これは視覚表現へのアクセスの民主化です。」彼はそれを活版印刷の発明に例えています。
しかし、それが芸術のさらなる発展にとって何を意味するのか少し心配です。つまり、次世代のアーティストが、最初から自由に使えるツールをすでに持っているため、ブラシと鉛筆の使い方をまったく学ばなかったらどうなるでしょうか?もし次のレンカ・ハモショヴァが絵を描くことを学ぶ必要がなかったらどうなるでしょうか。つまり、彼女は幼い頃からタブレットで指示を出し、ほとんど努力せずにすぐに印象的な絵を描くことができるからです。
「そんなに黒いとは思えないよ」とハモショバさんは反論する。 「私には姪や甥がいますが、彼らは今でも古典的な水彩絵の具で絵を描きたいと思っているようです。混乱を招く。そして彼らはモバイルを手に取り、モバイル上で創作を行います。それは連携して機能します。」
しかし、人工知能は当然、画像やビデオをより速く、より安価に生成するでしょう。私たちは人間の創造物に対する興味を失う危険にさらされているのでしょうか?人々は他に何を提供できるでしょうか?
説明: 頭に仮想現実ヘッドセットを装着した女性、長い赤い髪、黄色のドレス、アルフォンス ミュシャの絵画、花飾り、アール ヌーボーのスタイル。
ここで、ピアノを弾くという歴史的な比喩が思い出されます。現実的に言えば、今では誰もピアノを習う必要はありません。かつては音楽を家に持ち帰る唯一の方法だったのかもしれませんが、過去 100 年間はそうではありませんでした。それにもかかわらず、新しい世代の子供たちは音階や練習曲に苦労しています。諦めてから、私のようにソングジェネレーターに感謝する人もいます。
しかし、何千時間もトレーニングに費やす人もいます。そして、どこかで彼らがライブで演奏するとき、それは私たちが録音された音楽を聞くときとはまったく異なる体験を周囲の人たちに与えます。マシンの音を聞くと、その技術的なパラメーターについて考え、驚かれることがあります。私たちにはできないことをしている人を見ると、私たちは感動し、インスピレーションを受けることがあります。
私たちは、その人が「私たちの一員」であり、彼らが成し遂げたことは、私たちが人間として彼らと共有した何かの結果であることを理解しています。これが、人間が芸術において中心的な役割を果たし続けると私が考える理由でもあります。コンピュータが創造したり空想したりできないからではありません。しかし、コンピュータ アートは間もなくあらゆる場所に普及するでしょう。
おそらく、人間の創造性はますます稀なものとなるでしょう。一部のアーティストは AI ツールを拒否しますが、その理由は彼らにもわかります。人工知能の支援により、創造性に新たな次元を与える人もいます。試してみれば、これらの魔法の箱を使って、私たち人間が何であるかをさらに良く示すことができるかもしれません。
(記事には厳選された箇所のみが掲載されています。全内容については、ポッドキャストの音声またはビデオ版を聞いてください。特にビジュアル アートに関するこのエピソードについては、ビデオを視聴することを特にお勧めします。ビデオには、すべての例が含まれているためです。ツールについては言及されています。)
パブレ・カシクのモザイク
8 部構成のミニシリーズ 人工知能のニュースのリスト。ジャーナリストのパベル・カシックがゲストの助けを借りてテクノロジー現象の現状を説明します。さまざまな視点から、装飾のない AI を紹介します。パベル・カシックのモザイクは、毎週木曜日にビデオとしてセズナム・ズプラフのウェブサイトで、音声形式で公開されています。 ポッドカスティ.cz、 スポティファイ、 りんご。
写真:ニュース一覧
Pavel Kasík の Mosaic – 人工知能に関するポッドキャスト ミニシリーズ。
#画像生成器は窃盗から始まったとアーティストは語る