見出し画像

日刊 画像生成AI (2022年9月19日)

画像生成AI界は、今認識できないスピードで進化をし続けています。
DALL・E2公開、Midjourney公開、StableDiffusionがオープンソースで公開されて..進化の速度が上がり続けており、日々異常なスピードで変化しています。

"誕生の予感"

そんな中、毎日時間なくて全然情報追えない..!って人のために業界変化、新表現、思考、問題、技術を毎日あらゆるメディアを調べ、まとめています。


昨日までの投稿はこちら


開発


Lexica.artがアップデート。画像検索できるように。

画像検索できるように進化しました。(スマホならカメラ起動してそれで検索もできる)。どんどんGoogleっぽくなっていきますね。Stabilty.aiのCEO Emadさんの言うジェネレイティブサーチエンジンを作ろうとしてそう。

https://lexica.art/


Auto SD Workflow

このツールこれまで紹介してきた中で、人によってはダントツでいいですね。設定さえすればどんどん生成されていき。以下のPatronから課金すれば手に入るそうです。以下リンクから。

最初はざっとこのように画像をポンポンと生成し、気に入ったのをsaveして、それをstepsの値違い、scaleの値違いをポンポン出していき、お気に入りを探していくというもの。

最後にこれだ!って決めたら、img2imgでバリエーションを出したり、インプットした画像のバリエーションもたくさん生成したり、また最後にstepsの値違いをいっぱい出したりなど、色々できる。本当に何か最高の一枚を求めている人にはぴったりのツールですね。


Stable Diffusionのプロンプトをオートコンプリート/生成する AI

"Magic Prompt"と呼ばれるものが開発されました。これはAI の画像処理用のプロンプト テキストを生成することを目的としたGPT-2モデル。少しプロンプトを入力したらその先を補完してくれるようです。

https://www.reddit.com/r/StableDiffusion/comments/xhvey7/i_created_an_ai_to_autocompletegenerate_prompts/

DALL・E版もありました。


Optimized Stable Diffusion (neonsecret) v1.0.5

Stable Diffusionの改良版で有名なものの一つ、Optimized Stable Diffusionがアップデートされていたようです。(18日公開だった。)さらに超高速になり、さらに高解像度になり、k_diffusionサンプラー、CodeFormerと他upscalerも搭載されているとのこと。リンクは以下に。

https://www.reddit.com/r/StableDiffusion/comments/xhjz04/introducing_the_ultimate_ui_a_new_way_to_use/

使ってみました。txt2imgからimg2img, inpainting, interpolate(補間), upscaleまで搭載されており、機能が豊富です。

8 GB のvram で 2048x2048、24 GB で 3200x3200までいけるとのこと。風景画像とかなら、超高解像度でも違和感ないのを見たことがあるので、そういうの作ってみたいです。


Stable Diffusion for Krita

以前あったKritaでStable Diffusionを使うプラグインはこの方は使いにくかったそうです。この方の目的は、非常にユーザーフレンドリーでデザイナー向けのものを作ることだそう。現在Linuxで動作しますが、今後windowsも対応するとのことです。以下相違点と悪い点。

私のプラグインにおける主な相違点
・ノンブロッキング。画像を生成し、新しい世代が表示されるのを待つ間、作業を継続することができます。
・オプションのNSFWフィルターにより、ストリーミング中でも安全に使用可能
・ウォーターマークをオフにする機能
・モデルの入手先、使用するドライバなどのインストール手順
・ウェブサーバーなし - 既存のプラグインはStable Diffusion webuiのフォークであり、ウェブサーバーを使用します。
・クリーンで文書化されたコード
悪い点
・RabbitMQが必要 - この依存関係を取り除くために、積極的に取り組んでいます。その進捗はstablediffusiondのレポで見ることができます。
・デーモンに依存している - これはRabbitMQの要件と関連しており、この問題と同時に解決しています。
・Ubuntuでのみテスト済み - Windowsでのテストは近日中に行う予定です。

https://www.reddit.com/r/StableDiffusion/comments/xhwy59/a_new_krita_stable_diffusion_plugin/


表現


Midjourneyでハイクオリティな映像作品を制作する

Midjourneyならではの特徴を利用し、質の高いアニメーションを作られている例。以前雷でやられていて話題になった方ですね。


img2img Photobashのワークフロー

あぶぶさんのimg2imgとPhotobashを使ったワークフロー。クオリティが高いのでとても参考になります。


研究


画面解像度の検証

海行プログラムさんの検証。(以降続きます)
SDは512x512で学習されているので巨大すぎる画像はあまり有効ではないことがわかるいい事例。


Stable Diffusionの追加トレーニングについて

追加学習させたい人は必見。それに関わる情報がたっぷり詰まっています。


各モデル女の子生成事例まとめ

Waifu Diffusion, Trin Art, Stable Diffusionでの女の子のキャラクターの生成の素敵な事例がまとまっています。


Textual Inversionで学習させた概念を綺麗に生成するためのプロンプトエンジニアリング


思想・ムーブメント


AIで作られたアートアークの本がKICKSTARTER達成

https://www.kickstarter.com/projects/thibaudz/pirate/?ref=bio


次のEコマースの動画 (服版)


Midjourneyのアートを飾る。

投稿者の奥さんが部屋を装飾するためにMidjourneyで生成したものを飾られているそうです。Redditで伸びていたのでメモ。

https://www.reddit.com/r/midjourney/comments/xhtai3/beginners_guide_to_midjourney/


『創造がゼロになる時』


ニューラルネットワークは、アナロジーで「考える」ことができるのか?


最後に


Twitterに、毎日製作したものや、最新情報、検証を載せたりしています。よかったらフォローしてくれるとうれしいです。

実験、最新情報まとめはこちら

https://twitter.com/i/events/1560957489730179077


前回の号はこちら

次の号はこちら


いいなと思ったら応援しよう!

やまかず サポートいただけると喜びます。本を読むのが好きなので、いただいたものはそこに使わせていただきます