それぞれのAIの特性を活かす!【Grok,Nano Banana, SeeDream】
記事のサムネイルに釣られて来た方もちょっとだけ寄って行きませんか?
2023年春から、AIグラビアを追いかけて、お陰様で今日までやって来れました。今日はちょっと真面目な記事になります。
なぜAIグラビアなのか
美しいものへの憧れや、絶対手に入らないものを手に入れたような錯覚、長いこと探し続けてきたモノを発見した喜び、そんな興奮が、脳のどこかを刺激して、快楽物質が放出される。おそらく、これは男が持っている本能の一部なのではないだろうか。
ついつい生成ボタンをポチってしまう。
その生成ボタンの性能をどうやったら高められるのか、私はその一点にのみ集中してきた。
Comfy-UIとDrawThings
巨大戦艦「Comfy-UI」に乗れば、ありとあらゆる作戦を取れ、大海を自由に謳歌できるのですが、私が乗っているのは軽巡洋艦「DrawThings」なので、取れる作戦や火力の面では劣ります。
何を言いたいのかと言えば、Comfy-UIの環境をローカルでもクラウドでも構築している方は、あの程度のアイキャッチでは釣られないのは知っています。私はComfy-UIを知らない。乗り換える気もない。この軽巡洋艦でどこまでやれるのか、試してみたいのです。
生成メソッドの工夫
noteで流れてくる記事のほとんどは、1つのAIをターゲットにしているものがほとんどです。
リアリティ重視:Nano Banana 2 / Pro
可愛さ重視:GPT Image 2.0
ちょっとH:Grok Imagine Pro
しかし、AIの本当の凄さは、リジェネレート(再構築能力)なのです。そして、そのリジェネレートは経験しないと、本当の意味での理解には到達しません。
メソッド:「 プロンプト ➡️ 画像 」
これをT2I(Text to Image)と言います。これは、そのAIが文字情報から画像を構築する単なる生成です。
この生成によって作られた画像は、必ずそのAIの癖のようなものが出てしまいます。何回も生成しているとだんだん飽きてきます。
メソッド:「 画像 ➡️ 画像 」
これはI2I(Image to Image)と言います。この場合、入力画像もそのAIで作られた場合は、やはりそのAIの癖は抜けません。しかし、入力画像を違うAIで作ることで、化学反応が起こるのです。
受け取ったAIは、自分の知識には無い情報を入力されたので、「それ、ワタシ知らないんですけど、とりあえずこうですか?」と出力してきます。
これが、とっても重要な気がするのです。
つまり、1枚の絵を描くにしても、2つ以上のAIを使ってI2Iする事で、想像を超えた作品に出会えます。
また、複雑な工程を踏むことにもなるので、苦労もします。だからこそ、得られる達成感のようなものが、オマケで付いてくるのです。
用途別AIの選択
ちょっとAIの特性を見てみましょうか。使ったアプリはこちらです。
プロンプトは、これで行ってみます。
Create image of modern 20s beautiful Japanese.
色白ナチュラルメイク平成コギャル。全身画像。
Nano Banana 2(4K)


これは、私にとっては必須のAIです。T2IもI2Iも両方こなします。しかも、使用料がかからないのです。4K作画してみたのですが、このリアリティは活用しない手はありまん。
GPT Image 2.0(4K)


同じプロンプトで、ここまで解釈が違うのです。Nano Bananaとは全く違うセンスを持ったAIである事が分かります。
足の指でエラーが出ていますが、肌の質感ではNano Bananaが上と言った所でしょうか。
Grok Imagine Pro(2K)


最大解像度が2Kなのもあって、リアリティ面では若干劣るGrokです。ただ、整った顔立ちは意外と使える要素です。
また、Nano BananaやGPT Image 2では通らないプロンプトが通るのもGrokの強みとなっています。
何せ、こんな絵を描けるのですから…。
ここから先は
いただいたチップはクリエイターとしての活動費に使わせていただきます!
