見出し画像

日刊 画像生成AI (2022年9月20日)

画像生成AI界は、今認識できないスピードで進化をし続けています。
DALL・E2公開、Midjourney公開、StableDiffusionがオープンソースで公開されて..進化の速度が上がり続けており、日々異常なスピードで変化しています。

"影響が広がってゆく"

そんな中、毎日時間なくて全然情報追えない..!って人のために業界変化、新表現、思考、問題、技術を毎日あらゆるメディアを調べ、まとめています。


昨日までの投稿はこちら


開発


Runway モーショントラッキング機能搭載。

以前話題になった魔法のAI動画編集ツール Runwayに新機能追加。 ワンクリックで、モーショントラッキングができるようになったようです。現在利用可能とのこと。 動画編集スキルの壁がどんどん無くなってる


Text-to-pokemon登場

テキスト入れたらそれに合わせたポケモンが生成されます。ぜひ遊んでください、朝いくつか試していましたがこれは楽しすぎました。

この方が書かれたファインチューニングのためのガイド


NMKD Stable Diffusion 1.4.0 GUI

WindowsでローカルでStable Diffusionを動かせるソフト、NMKD Stable Diffusionがアップデート。主なトピックとしてはinpainting, HuggingFace conceptsの利用, VRAM最適化、プロンプトごとにモデルを再読み込みする必要がなくなったとのこと。

変更点 詳細
・新しい画像が生成されるたびに安定拡散モデルを再読み込みする必要がなくなりました。
・マスクベースの修復のサポートを追加。
・HuggingFace .bin コンセプト (テキスト反転埋め込み) の読み込みのサポートを追加。
・追加されたプロンプト キューにより、プロンプトをその設定でキューに入れることができます。
・追加されたプロンプト履歴により、以前のプロンプトを表示またはロードできます
・現在の画像の生成の進行状況を示す進行状況バーを追加
・終了時にサウンドを再生および/または通知を表示するオプションを追加
・変更ログとパトロンを表示する「ようこそ画面」​​を追加
・以前のシードを使用するか、リセットするためのボタンを追加しました
・プロンプト フィールドを 2 倍の高さに拡張するボタンを追加
・DPI スケーリングの適切なサポートを追加
・後処理がロー メモリ モードで動作するようになりました
・特に通常モードでの VRAM のさらなる最適化
・利用可能な CUDA GPU がウィンドウ タイトルに表示されるようになりました
・プログラムの実行中に Windows がスリープ状態にならない (未テスト)
・GFPGAN モデルを 1.4 に更新
・空の「不明なプロンプト」フォルダーが作成されるバグを修正しました
・Python環境に関するいくつかの問題を修正

https://www.reddit.com/r/StableDiffusion/comments/xjacbf/nmkd_stable_diffusion_gui_140_is_here_now_with/


Image Variation Huggingface, colab

以前公開されて話題になった、生成されたものの似てるバージョンを生成するImage Variationを試せるHuggingface、colabが公開。

僕のアイコンのキャラ、やまかずうーぱーで試してみました。
僕のアイコンはNSFWらしいです。なんで
設定変えたらいけた。右下かわいい。
steps下げた。そりゃそうか..。なんか全部こわ。
この辺り良さそう。プンプンっぽい


DALL・E顔のアップロードがOKに

OpenAIに登録されていた方にはメールが届いています。顔写真のアップロードをしようとするとできない仕様になっていたのですがその制限が解除されました。ディープフェイクによる被害を最小限に抑えながら、楽しくて重要なユースケースをサポートするために、安全システムの改良を行ったとのこと。

届いていたメール


memeplex。 iPhoneやiPadでインペインティング!?現実から虚構を生み出す新機能を実装

清水さんの無料でStable Diffusionや、他のいろんなモデルも使えるmemeplexがアップデート。なんとインペインティングがブラウザからできるそうです。


TrinArt v2がdiffuserで実行できるように


rinnaが日本語で学習したJapanese Stable DiffusionがHugging Face Spacesでデモ化


Stable Diffusion for Photoshop inpainting機能近日公開

inpainting機能搭載は正直嬉しすぎますね。Photoshopのニューラル選択とレイヤーマスクと組み合わせると、非常に強力になるとのこと。colabでやってる方からするとこんなにシームレスに使えるのは素晴らしいってなると思います。


Midjourneyで作られた絵日記


AIお絵かき人狼『AIアートインポスター』発表

やってみないとあまり良さが分からないですが、一人だけAIにイラストをお願いするためのテーマを知らされてない人がいて、その人を見つけるというルールだそうです。


表現


拡大してミクロの世界へ

イームスの「Powers of Ten」に似た表現をAIを使ったアニメーションで生成しています。


キャラクターの回転

綺麗に人が回転してるAIアニメーションも最近増えてきている印象です。こちらはかなりよかったのでメモ。


研究


Stability Diffusion を超高品質の画像圧縮に利用する方法について

Stable Diffusionは非可逆圧縮に使用でき、非常に強力な非可逆画像圧縮コーデックの基礎となるということ。なるほど..そんな活用方法があるのか。


ホロライブ グラちゃんのDream Booth

Stable Diffusion公式Discordでホロライブのぐらちゃんをtextual Inversionよりクオリティの高いDreamBoothで追加学習したモデルとのこと。精度がかなり高いですね。ckptファイルは以下に
漁りました。リンクこちらです。


Stable Diffusion Web UIで Textual Inversionの学習済みモデルを利用する。


Photoshop x img2img のワークフロー

落書き
生成
Photoshopでペイントオーバー
img2img(質がすごく上がってる。img2img→調整→img2img→調整→..のワークフローはいいですね。)
https://www.reddit.com/r/StableDiffusion/comments/xiwkhy/here_is_an_example_of_my_img2img_with_stable/


思想・ムーブメント


日経がStable DiffusionのCEO Emadさんに取材


NVIDIA,次世代GeForce「GeForce RTX 4090」と「GeForce RTX 4080」を発表

(ぶあつい)


『神と機械について』 人工知能の未来は、ユートピアでもディストピアでもなく、もっと面白いものです。


15日時点でMidjourney RedditユーザーをStable Diffusionユーザーが超えていた。

https://www.reddit.com/r/StableDiffusion/comments/xj1twp/so_5_days_ago_we_guys_overtook_rmidjourney/


急速な変遷

私たちは、「AI はアートではありません」から「プロンプトを共有してください」から「彼らのアートはあまりにも優れています。彼らはこれらの AI 企業のために働いているに違いありません」に急速に移行しました。


最新のDeepfake検出に取り組まれているようです。

Stabilty.aiのCEO Emadさんがツイート。新しいOpenCLIP モデルなどを使用した最先端のディープ フェイク検出に取り組まれているそうです。まもなく発表する予定とのこと。


勉強


Textual Inversionの論文まとめ


スキルアップAI GAN編

こちらリアルタイムで参加していましたが資料が公開されました。Ganの歴史や仕組みの話が書かれていますが、最後に最近の話題のモデルについて語られています。


最後に


Twitterに、毎日製作したものや、最新情報、検証を載せたりしています。よかったらフォローしてくれるとうれしいです。

画像生成AIの実験, 最新情報のまとめはこちら


前回の号はこちら

次の号はこちら


いいなと思ったら応援しよう!

やまかず サポートいただけると喜びます。本を読むのが好きなので、いただいたものはそこに使わせていただきます