見出し画像

日刊 画像生成AI (2022年9月6日)

画像生成AI界は、今認識できないスピードで進化をし続けています。
DALL・E2公開、Midjourney公開、StableDiffusionがオープンソースで公開されて..進化の速度が上がり続けており、日々異常なスピードで変化しています。

"なにやら変化の予感がする.."

そんな中、毎日時間なくて全然情報追えない..!って人のために業界変化、新表現、思考、問題、技術を毎日あらゆるメディアを調べ、まとめています。


昨日までの投稿はこちら
(見てくれる人かなり増えてきました、お役に立てて嬉しいです。)


開発


DreamStudioが、Stable Diffusion 1.5vに対応。

アーキテクチャ自体の変更はなく、400k以上のucgステップにより、全体的に品質が向上するはずですが、パラメータとファイルサイズは同じだそうです。本格的なモデルのリリース自体は2週間後。


NMKD Stable Diffusion 1.3.0にアップデート

Windows用(現在はNvidia GPUのみ対応)誰もが求めていたシンプルなStable Diffusionのオールインワンインストーラ。インストールするだけで簡単に使えちゃいます。このNMKDがアップデートされました。

主な修正としては、メモリ使用量が減ったoptimized stable diffusionを含み、アップスケーリング機能、顔修正機能、seamless modeが追加されました。


Stable Diffusion WebUI (by AUTOMATIC1111)最強に?

WebUIにいつの間にかかなり機能が増えています。すごい。重さが改善されていたら現状最強になりますね。

画像の外側を補完(Outpainting)

Loopback
出力した画像をまた利用し、反復させてクオリティを上げることができるそうです。これは検証したことがないので一度やってみたいです。

あくまでこれは厳選された結果らしいです。

塗りつぶして置き換え。(Inpainting)

アップスケール機能

Textual Inversion(学習させてオリジナルのPromptを利用する)
事前トレーニング済みのtextual inversion embeddingsを利用できるようです。嬉

サイズ変更(Resizing)

X/Y プロット機能
Samplerと設定の結果を一気に検証できるそうです。素晴らしいですね。最初にこれをやって、あとはディテールを詰めるということができそうです。

https://twitter.com/CoffeeVectors/status/1567015989824393218

GFPGAN
顔を修正できるモデルも内蔵。

コードはこちら。


Long Stable Diffusion

長いストーリーをイラスト化生成してくれるように改造されたStable Diffusion、「Long Stable Diffusion」が登場しました。Stable Diffusion は短いプロンプトしか取得できません。完全にストーリーを説明する画像を説明するためのプログラムが作られています。

長い文章
→GPT3で「開始、中間、終了」の3つを生成。
→英語からプロンプト英語へ(クオリティを上げる接尾辞を追加)
→Stable Diffusionで生成


DALL·E 新Chrome拡張登場

DALL・E専用、DALL・E Keyword Dictionary - Dallelistが登場。Redditで1.8k獲得。これは人気ツールの予感。特徴は以下に記載。

すべてのキーワードは慎重にキュレーションされ、テストされました。
🔥テーマ別に分類 - 絵画、写真、デザイン、その他もあります
🔥 Dall-Eがよく認識できる有名な画家、マンガ&コミック、その他...
🔥 有名な写真家、写真のモディファイのキーワード
🔥 OpenAIのウェブサイトで直接動作するので、ワークフローを妨げることはありません。

作者によると、今後さらなる機能が追加されていくらしいです。楽しみすぎる。

ダウンロードリンクはこちら。


CPUで動くStable Diffusion公開

Stable Diffusion UI v2(by cmdr2)が公開されました。これはローカル環境で実行できる上、GPUではなくCPUで動作できます。


表現


ゲームキャラのリアル化

ピーチ姫
ラプンツェル


横移動のStable Diffusion動画流行。

これまでずっと奥に進む表現だけみんな検証していましたが慣れてきたのかちょこちょこ横にスクロールするような表現の動画も増え始めました。これはこれで面白いですね。

https://www.reddit.com/r/StableDiffusion/comments/x6zx9t/deforum_portrait_gallery/

こういう一連の表現、#warpfusion タグがよくついている。こういう名前の表現なんですかね。

たまに見かけるゴリゴリ角度を変えるこのような映像も多いです。この方はかなり上手いですね、素晴らしい作品です。


美しいアート メモ

9月6日中で個人的に美しいと思った生成画像をセレクト。


巨大すぎるOutpainting

Outpaintingで解剖図を広げて、300MBの画像を生成した人が現れ、話題になっています。

https://www.reddit.com/r/dalle2/comments/x791jn/sliced_anatomical_diagram_of_homers_complex/


『隠された神』

想像が膨らむ素敵すぎるmidjourneyで生成された作品。前にTwitterでも少し伸びてましたが、Redditでも700いいねを超えてました。素晴らしい作品だったのでシェア。

https://www.reddit.com/r/midjourney/comments/x6pmsl/the_hidden_gods/


偽の歴史

こちらのツイートも伸びていたのでセレクト。偽の浮世絵を作るのも色々可能性があるので流行りそうですね。


研究



playable Pokémon overworld

個人的にこれやばかったのですが、現在のフレームとコントロールから次のビデオフレームを予測するようにトレーニングされたものらしく、生成された画像の中を歩いていく、特殊な感覚を味わえます。この未知の感覚素晴らしい..。

ここから遊べます。衝撃です

解説はこちら。


女の子のPrompt 100個配布

yuuさんが制作。Stable Diffusionで同一シードで末尾の画風的なものを変えて100パターンくらい出力されたそうです。こんなにいっぱいまとめられるのすごいです。


ボードゲームのアイデア生成

ゲームのアイデア出しとして活用している事例。こういう使い方もあるんですね。


Promptの「greenscreen」はphotoshopでの利用に有効。

https://www.reddit.com/r/StableDiffusion/comments/x6tn42/greenscreen_in_the_prompt_is_useful_for_masking/

顔の部分はARCを繰り返せば綺麗になるそうです。


思想・ムーブメント


「AIアートはアートです。」

有名な方がツイートされていたので、翻訳を添付しておきます。僕も同じように思っています。画像生成AIがやっていることは基本人間と一緒で、そのままほぼパクることもできちゃうし、それは人間と同じようなルールで指摘できるかと思います。

AI アートはアートです。
人間と同じように、AI は複数のソースからインスピレーションを得て、それを処理して何か新しいものを作成します。
出てくるものは素晴らしい場合もあれば、そうでない場合もあります。
AI アートはアートです。


最後に


Stable Diffusion 1.5vが楽しみすぎる…ので、DreamStudioで早く触ってみようと思います。(前Discordでも触ったけどちょっとしか触れなかったのでこれで触りたい。)あと割といろんなプラットフォーム対応してきてるので、今後はLong Stable Diffusionのようなカスタマイズされた実装が今後増えていきそうな予感がしています。


Twitterに、毎日製作したアートや、最新情報、検証を載せています!
よかったらフォローしてね
https://twitter.com/Yamkaz



次号はこちら


いいなと思ったら応援しよう!

やまかず サポートいただけると喜びます。本を読むのが好きなので、いただいたものはそこに使わせていただきます