見出し画像

日刊 画像生成AI (2022年9月2日)

画像生成AI界は、今認識できないスピードで進化をし続けています。
DALL・E2公開、Midjourney公開、StableDiffusionがオープンソースで公開されて..進化の速度が上がり続けており、日々異常なスピードで変化しています。

"光の速さで進むAI"

そんな中、毎日時間なくて全然情報追えない..!って人のために業界変化、新表現、思考、問題、技術を毎日あらゆるメディアを調べ、まとめています。


昨日までの投稿はこちら
(いいねくれるとやる気がでます)


次の投稿はこちら


技術・開発


LexicaにGodモード登場

https://lexica.art/  というおそらくStable DiffusionのDiscordで生成されたものをスクレイピングしたdbが海外で誰か公開していたのでそれを可視化したものかと思われます。その便利ツールが、Pinterestのように見れるようにアップデートされました。結構話題になっていますね。

画像もPromptもセットで見れるので便利です。先日紹介したKREAというサービスもあるのでぜひ。


The Ai Art登場

細かいテクニックや、アングル、フィルターなどいっぱい入ってて嬉しいですね。こういうちゃんと分類されている事例はkeyword referenceとか、notionとか、google sheetsにまとめていることが多いので、こういうすぐコピペできて、分類されているサイトは有効だからすぐ出るな..って思っていたら出ましたね。

この項目数、嬉しい。他のReferenceと比べると少ないですがこれか増やすのではないでしょうか。一旦リリースした感じでは。


英語版 ernie_vilg登場


Fine-tuningができるcolab notebook続々登場


M1Macで画像1枚あたり~15秒の速度を可能に

あるプログラマーの方がStable Diffusionをフォークして、M1Macでこの速度での生成を可能にしました。やばい。これは早くやりたい。


表現


新しいキャラクター生成

新しい動物作ってみた、新しいキャラクター作ってみた。など創造性が加速している。新しいOO作ってみたは割とトレンドですね。

https://www.reddit.com/r/midjourney/comments/x381r2/new_marvel_villains/


ねんどろいど

ねんどろいどの描画がstablediffusionが上手いのですが、おそらくそれを取り込んでいるのでうまいです。それに気づいた人たちの投稿が伸びています。


新しい服生成


img2imgで実写映像→アニメが流行ってます。

最近いくつも見かけるようになってきました。1つのトレンドですね。
これ系ではremiさんが一番強い。

https://www.reddit.com/r/StableDiffusion/comments/x3g68e/lalaland_as_an_animation/


remiさんの映像


設計図

設計図系は常にトレンドですね、いろんな人がやってる。


油絵 × 溶ける蝋人形シリーズ

蝋人形表現もいくつか見かけることが増えてきました。質感の細かいところが美しいですよね。Brahma_godという方が開発したpromptらしい。
他のユーザーから「これは本当に素晴らしいことです。Stable Diffusionから生まれた他の製品とは異なります。」と褒められていました。

https://www.reddit.com/r/StableDiffusion/comments/x3fmrj/melting_wax_series/

📝 豆知識
ちなみにpromptはこれだそうです。
close-up portrait of [something] by irakli nadar with intricate detailed color smashing fluid oil paint and acrylic, melting wax, mycelia, abstract impressionism, ruan jia, fantasy, hyper detailed, concept art, by peter mohrbacher and gustav klimt

Midjourney→DALLE2補間

DALL・E2のOutpainting出てみんな盛り上がるかと思ったけど、意外とでしたね..笑 出る前から結城浩さんがよくやられていたのでシェア。素敵な挑戦。


pharmapsychoticさんの映像


ダジャレ+画像生成

これはBread Seeran。有名人 x 画像生成はかなり多いですが、駄洒落の事例は初めて見ました。Redditで伸びてます。

https://www.reddit.com/r/StableDiffusion/comments/x32i50/bread_sheeran/


Stable + Latent + 深度推定モデル

テクニカルディレクター、Saito Akiraさんの実験が日々続いていますね。
深度推定モデルはこちら。


研究


同じアーティストを使った500名以上のPrompt研究

https://www.reddit.com/r/StableDiffusion/comments/x32dif/study_of_500_artists_using_the_same_prompt/


Promptまとめ系ブログ

増えてきましたね。どんどんこれでPromptエンジニアが増えていきそう。852話さんも今朝書かれてましたね。


852話さんPrompt販売

イラストレーター界隈のAIで有名な方、852話(ハコニワ)さんがkawaiiのpromptを販売。これは売れるよね..悔しい。800万円ぐらい売り上げるのでは


LAIONデータベースの可視化


サンプラーによって手と顔はどう変わるのか?

サンプラーの知識は結構必要なので、またこの研究事例が増えてありがたいです。


日本でもTextual Inversionしてる人が増えてきた

増えてきましたね。これはヤベェ!って状態になっている人はまだおらずです。皆さん研究中..という感じですね。世界でもいい感じに成功してる事例はポケモンの事例1点くらいです。あとは論文に書かれてるやつぐらい。


img2imgでstrength を指定した場合にどれだけ変化するのか

strengthは割と個人的に感覚で触っていただけど他の人の事例だとどうなるか気になるのでとてもありがたいです。


思想・ムーブメント


shi3zさんが業界について解説してる動画

・diffuseについて
・今後diffuseにまとまっていく。
・midjourneyは15000GPU使ってる。日本ではそのレベルのは無理。
など、かなり前から情報を追っていたshi3zさんだからこそ分かる情報が語られていました。本気で面白い。


mimic叩いたら、中国のAIサービス出たという件について

IngaSakimoriさんがこの件について、ある論を展開されています。結論としては「別に不安になることはない。逆に日本風イラストの供給元として、ビックデータの供給元として日本のオンリーワンは加速する。」とのこと。なるほど。


絵画コンクールで1位取っちゃった人の話、その続き。

あぶぶさんのこの意見が一番正しいと思います。競技としては全く別のものですからね。いくらPromptやプログラミング技術が上がっても、手で描く絵は上手くなってない。


学習データに今後含まれないことが逆に問題であるという視点

これは僕も思っていました。学習された側からしたら短期的には損ですが、使う人類全体側からすると大きな進歩だし、そっちの方が消費者からすると良くなると思いますね。翻訳システムも、カメラも、印刷機もそのように進化してきています。


ソフトウェア3.0

スタートアップ投資家のsarah guoさんがブログでこの流行りのこれまで、これからについて、ソフトウェア3.0について語られています。「自分の想像したキャラクター、自分に合った生成された音楽、自分に合った絵が出る本があっては行けないのか。」「今後は、「ノーコード」なのか、それとも「生成コード」なのか。」など


まだ始まったばかり。

ディープラーニング分野で最も偉大な研究者の1人であるヒントン氏のコメント「私は、最近の大規模な言語モデル、画像生成、タンパク質の構造予測における目覚ましい進歩は、ディープラーニング革命がまだ始まったばかりであることの証拠だと考えています」


最後に


今日は開発の視点では大きな進歩はありませんでしたが、個人の研究や考察、表現の開発がまた進んでいますね。明日も楽しみ。

(この辺り情報足りてないとかありましたら、指摘してください。その部分も追って入れておきます)

Twitterに、毎日製作したアートや、最新情報、検証を載せているのでよかったらフォローしてね
https://twitter.com/Yamkaz


いいなと思ったら応援しよう!

やまかず サポートいただけると喜びます。本を読むのが好きなので、いただいたものはそこに使わせていただきます