日刊 画像生成AI (2022年9月6日)
画像生成AI界は、今認識できないスピードで進化をし続けています。
DALL・E2公開、Midjourney公開、StableDiffusionがオープンソースで公開されて..進化の速度が上がり続けており、日々異常なスピードで変化しています。

そんな中、毎日時間なくて全然情報追えない..!って人のために業界変化、新表現、思考、問題、技術を毎日あらゆるメディアを調べ、まとめています。
昨日までの投稿はこちら
(見てくれる人かなり増えてきました、お役に立てて嬉しいです。)
開発
DreamStudioが、Stable Diffusion 1.5vに対応。
アーキテクチャ自体の変更はなく、400k以上のucgステップにより、全体的に品質が向上するはずですが、パラメータとファイルサイズは同じだそうです。本格的なモデルのリリース自体は2週間後。
Stable Diffusion 1.5 beta now available to try via API and #DreamStudio, let me know what you think.
— Emad (@EMostaque) September 6, 2022
Much more tomorrow…https://t.co/eosxNTuOvL
Great news - v1.5 of Stable Diffusion is available for anyone to try out in DreamStudio! 🥳
— Stable Diffusion 🎨 - News, Art, Updates (@StableDiffusion) September 6, 2022
Simply go to https://t.co/gE7edwYI3R
The model used is now a new option on the website (see second picture).
Full model release of v1.5 is coming soon shortly. Stay tuned! pic.twitter.com/4MfJiWUXSZ
NMKD Stable Diffusion 1.3.0にアップデート
Windows用(現在はNvidia GPUのみ対応)誰もが求めていたシンプルなStable Diffusionのオールインワンインストーラ。インストールするだけで簡単に使えちゃいます。このNMKDがアップデートされました。
主な修正としては、メモリ使用量が減ったoptimized stable diffusionを含み、アップスケーリング機能、顔修正機能、seamless modeが追加されました。

Stable Diffusion WebUI (by AUTOMATIC1111)最強に?
WebUIにいつの間にかかなり機能が増えています。すごい。重さが改善されていたら現状最強になりますね。
画像の外側を補完(Outpainting)

Loopback
出力した画像をまた利用し、反復させてクオリティを上げることができるそうです。これは検証したことがないので一度やってみたいです。

塗りつぶして置き換え。(Inpainting)

アップスケール機能

Textual Inversion(学習させてオリジナルのPromptを利用する)
事前トレーニング済みのtextual inversion embeddingsを利用できるようです。嬉

サイズ変更(Resizing)

X/Y プロット機能
Samplerと設定の結果を一気に検証できるそうです。素晴らしいですね。最初にこれをやって、あとはディテールを詰めるということができそうです。


GFPGAN
顔を修正できるモデルも内蔵。

コードはこちら。
Long Stable Diffusion
長いストーリーをイラスト化生成してくれるように改造されたStable Diffusion、「Long Stable Diffusion」が登場しました。Stable Diffusion は短いプロンプトしか取得できません。完全にストーリーを説明する画像を説明するためのプログラムが作られています。
長い文章
→GPT3で「開始、中間、終了」の3つを生成。
→英語からプロンプト英語へ(クオリティを上げる接尾辞を追加)
→Stable Diffusionで生成
I really wanted to illustrate long stories with Stable Diffusion! So, hacked together this pipeline:
— Sharon Zhou (@realSharonZhou) September 6, 2022
Long text ->
GPT-3 suggests illustration ideas ->
GPT-3 translates from English to "prompt-English" ->
Stable Diffusion outputs images
Open source 👇🏿https://t.co/GzXpyUyOBF
DALL·E 新Chrome拡張登場
DALL・E専用、DALL・E Keyword Dictionary - Dallelistが登場。Redditで1.8k獲得。これは人気ツールの予感。特徴は以下に記載。
すべてのキーワードは慎重にキュレーションされ、テストされました。
🔥テーマ別に分類 - 絵画、写真、デザイン、その他もあります
🔥 Dall-Eがよく認識できる有名な画家、マンガ&コミック、その他...
🔥 有名な写真家、写真のモディファイのキーワード
🔥 OpenAIのウェブサイトで直接動作するので、ワークフローを妨げることはありません。
作者によると、今後さらなる機能が追加されていくらしいです。楽しみすぎる。

ダウンロードリンクはこちら。
CPUで動くStable Diffusion公開
Stable Diffusion UI v2(by cmdr2)が公開されました。これはローカル環境で実行できる上、GPUではなくCPUで動作できます。
表現
ゲームキャラのリアル化


横移動のStable Diffusion動画流行。
これまでずっと奥に進む表現だけみんな検証していましたが慣れてきたのかちょこちょこ横にスクロールするような表現の動画も増え始めました。これはこれで面白いですね。

+++ ᵖş𝐲𝓒ᵒ ς𝐔ᵗє / ƇƛƬ ƇơɱƤuƬƖᴎɠ
— guruguruhyena🍥PƧYFΛM (@guruguruhyena) September 6, 2022
😺⚙🤖 0.99ꜩ $XTZ ♦︎ステレオ 03:13🔈♪⚡︎🐈https://t.co/K5NQwO6eDL#AIart #stablediffusion #Deforum #GANime #psychedelic #CleanNFT #tezosart #nftmusic #PSYfam pic.twitter.com/5lILMfr8VJ
ブログを書きました!
— cedro (@jun40vn) September 5, 2022
文から画像生成するモデルで、出力画像をズームやシフト等をさせ、それを初期値にして画像生成することを繰り返すと動画が出来ます。
今回ご紹介するのは deforum氏が開発した Stable Diffusion による動画生成をするGoogle Colabです。
ブログ:https://t.co/lhzilP6qjU pic.twitter.com/M7eWQKiuUb
こういう一連の表現、#warpfusion タグがよくついている。こういう名前の表現なんですかね。
"Monsters" #stablediffusion recursive animation. Check out the full 10min. 4k version here: https://t.co/WjYkSDy3Cl #ai #aiart #aiartcommunity #aiartist #zoom #surrealism pic.twitter.com/QQXPCD1HVC
— DrewMedina (@DrewMedina20) September 5, 2022
Figuring out the magik of #warpfusion by @devdef along with #stablediffusion 👁🪸👁 pic.twitter.com/205zsJu3VJ
— Infinite Vibes (@Infinite__Vibes) August 30, 2022
たまに見かけるゴリゴリ角度を変えるこのような映像も多いです。この方はかなり上手いですね、素晴らしい作品です。
first 30 seconds of a new animation with @deforum_art pic.twitter.com/1lGRx26kIQ
— 𝐑𝐢𝐤𝐤𝐚𝐫.tez.eth | #omencollective (@socalpathy) September 5, 2022
美しいアート メモ
9月6日中で個人的に美しいと思った生成画像をセレクト。
#AIart #digitalart #ai #art #abstractart pic.twitter.com/dZqmWft7bu
— Unlimited Dream Co. (@unltd_dream_co) September 5, 2022
I'm excited to have started a new collection on @objktcom today, "Ataraxis": a series of serene floral scenes that I will be building on over the near future.
— MANΞKI NΞKO 🌸 aiia 🌸 (@ManekiNekoAIArt) September 5, 2022
There are 3 pieces in this debut.
First is a 1/1: "The Golden Hour", on auction.
More in 🧵#aiia #stablediffusion pic.twitter.com/cvke2Gvm0T
巨大すぎるOutpainting
Outpaintingで解剖図を広げて、300MBの画像を生成した人が現れ、話題になっています。

『隠された神』
想像が膨らむ素敵すぎるmidjourneyで生成された作品。前にTwitterでも少し伸びてましたが、Redditでも700いいねを超えてました。素晴らしい作品だったのでシェア。

偽の歴史
こちらのツイートも伸びていたのでセレクト。偽の浮世絵を作るのも色々可能性があるので流行りそうですね。
江戸時代にPCが発明されていた偽史を作っている#stablediffusion pic.twitter.com/mRdYF0NkTi
— ところてん (@tokoroten) September 5, 2022
研究
playable Pokémon overworld
個人的にこれやばかったのですが、現在のフレームとコントロールから次のビデオフレームを予測するようにトレーニングされたものらしく、生成された画像の中を歩いていく、特殊な感覚を味わえます。この未知の感覚素晴らしい..。
For fun, I trained a neural network to mimic a playable Pokémon overworld (web demo in the post) https://t.co/yuodVssIAI pic.twitter.com/GdOpl6d3kY
— Ollin Boer Bohan (@madebyollin) September 5, 2022
ここから遊べます。衝撃です
解説はこちら。
女の子のPrompt 100個配布
yuuさんが制作。Stable Diffusionで同一シードで末尾の画風的なものを変えて100パターンくらい出力されたそうです。こんなにいっぱいまとめられるのすごいです。

100パターン分の呪文をまとめました魔導書公開しました。可愛い女の子を召喚する参考にしていただければと。 https://t.co/t708It11Nf #StableDifusion #StableDiffusionKawaii #midjourney pic.twitter.com/g5RmWiy8It
— yuu (@yuu_ai_novel) September 4, 2022
ボードゲームのアイデア生成
ゲームのアイデア出しとして活用している事例。こういう使い方もあるんですね。
#stablediffusion の新しい遊び方思いついた。「(適当な形容詞) + board game」というプロンプトを与えると、見たことのないけったいなボードゲームの盤面が出力されるので、それがどんなゲームなのかを想像する、というもの。 https://t.co/paC5kT1BgT
— Kentaro Fukuchi (@kentarofukuchi) September 5, 2022
Promptの「greenscreen」はphotoshopでの利用に有効。

顔の部分はARCを繰り返せば綺麗になるそうです。
思想・ムーブメント
「AIアートはアートです。」
有名な方がツイートされていたので、翻訳を添付しておきます。僕も同じように思っています。画像生成AIがやっていることは基本人間と一緒で、そのままほぼパクることもできちゃうし、それは人間と同じようなルールで指摘できるかと思います。
AI アートはアートです。
人間と同じように、AI は複数のソースからインスピレーションを得て、それを処理して何か新しいものを作成します。
出てくるものは素晴らしい場合もあれば、そうでない場合もあります。
AI アートはアートです。
AI art is art.
— Halli (@iamharaldur) September 4, 2022
Just like a human, AI will take inspiration from multiple sources, just like a human it will process it and make something new.
Sometimes what comes out is great and sometimes it’s not so great.
AI art is art.
最後に
Stable Diffusion 1.5vが楽しみすぎる…ので、DreamStudioで早く触ってみようと思います。(前Discordでも触ったけどちょっとしか触れなかったのでこれで触りたい。)あと割といろんなプラットフォーム対応してきてるので、今後はLong Stable Diffusionのようなカスタマイズされた実装が今後増えていきそうな予感がしています。
Twitterに、毎日製作したアートや、最新情報、検証を載せています!
よかったらフォローしてね
https://twitter.com/Yamkaz
次号はこちら
いいなと思ったら応援しよう!
サポートいただけると喜びます。本を読むのが好きなので、いただいたものはそこに使わせていただきます