見出し画像

Nano Bananaで遊ぶ(その2)

| 2.0 Flash | Nano Banana利用(遊ぶ その1 | その2)| Nano Banana Pro利用 |

Last update 9-20-2025
※ (11-23-2025) Nano Banana Proの記事を公開しました(上部のリンクより)。
※ とりとめも無く掲載しています。プロンプトの書き方等の参考になれば幸いです。




■ 0. 概要等

▼ 0-0. 注意事項

 Googleは、生成AIの使用禁止に関するポリシーhttps://policies.google.com/terms/generative-ai/use-policy)を公開しています。内容を確認してください。
 たとえば、「不適切な内容の画像を生成してはいけない」のはもちろんのこと、「権利上の問題が無い画像を使用する」ことも大事です。


▼ 0-1. はじめに

 過去の2つの記事で「Nano Banana(Gemini 2.5 Flash Image)」を利用して、様々な画像を生成してみました。本記事は利用する対象をGemini(https://gemini.google.com/app)に限定して、Nano Bananaをさらに試していきます。


▼ 0-2. 補足

 生成される画像の縦横比は最後に添付した画像をもとに決定する仕様になっているので、好みの縦横比にしたい場合は工夫が必要です。

 Geminiに指示した際に、文章のみの応答を返す場合があります。画像が生成できない場合は、下記のような文を頭に追加してみてください。

  • Generate image:

  • Please generate an image of the following (with no text respond):

  • 確認せずに次の画像を生成:

 なお、文章のみで少し変わった定型文を返す場合がありますが、やんわりと生成を拒否されている可能性が高いです。



■ 1. 事前処理(任意)

▼ 1-1. 対象の抽出

 写真や画像を添付して編集を行う際、人物だけを使いたいのに背景まで使われてしまう場合があります。このような時は、先に対象だけを抽出する方法が簡単かつ確実です。また、編集後もポーズが維持されてしまう場合があるので、立ち絵の方が扱いやすいかもしれません。

 下記は抽出例です。左の画像を入力したあと一つ目を入力すると中央の画像が、二つ目を入力すると右の画像が生成されました。

  • Generate image: 人物だけを残して背景を真っ白にする。

  • Generate image: 人物だけを残して背景を真っ白にする。人物を立たせる。

人物だけを抽出した(3枚の画像を連結して掲載)

▼ 1-2. 対象の全身化等

 ほかにも、身体の一部分が無い場合は先に全身を作っておくことで、編集時の一貫性が保ちやすくなるでしょう。別の服装を用意しておくこともできます。

 下記は一例です。左の画像を入力したあと一つ目をと入力すると中央の画像が、二つ目を入力すると右の画像が生成されました。

  • Generate image: 人物だけを残して背景を真っ白にする。人物を正面向きに立たせる。服は膝上丈のワンピースで、裸足でおしゃれなサンダルを履いている。

  • Generate image: 人物だけを残して背景を真っ白にする。人物を正面向きに立たせる。服は紺色のブレザー、白のブラウスでリボンは緑のチェック、リボンと同じ柄の膝上丈のスカート、白のクルーソックス、黒のローファー。

人物の全身を作成した(3枚の画像を連結して掲載)

▼ 1-3. その他

 ほかにも、3.では着用品のみの画像を先に作り、それを参照して着せ替えを行っています。



■ 2. Google提供のレシピ

▼ 2-1. はじめに

 2.ではGoogleが提供したレシピを紹介して、2つを試してみます。


▼ 2-2. Googleの投稿

 現在、Google JapanのXアカウント(https://x.com/googlejapan)では様々な利用方法がポストされています。かなりの数があるので、興味があれば確認してみてください。

 Geminiの公式noteにおいても、使い方の解説とともに何例かが掲載されています。


▼ 2-3. ガチャ化

 画像の人物や動物などをガチャにする例です。

 上記のポストに続けて掲載されていたプロンプトを利用してみました。入力した画像はそれぞれ、1-1.と1-2.で作成した立ち絵です。

人物がガチャになった(2枚の画像を連結して掲載)

▼ 2-4. 塗り絵化

 線画を抽出することは容易にできます。

 上記のプロンプトを利用してみました。

背景無しの線画だけになった(2枚の画像を連結して掲載)

▼ 2-5. 試着

 複数枚の画像を入力して、服装の変更ができます。3.で着せ替えを行うので紹介のみとします。



■ 3. 着せ替え

▼ 3-1. 概要

 任意の画像の人物の服装を、別の画像の人物に着せてみることを考えます。これは高性能なNano Bananaといえども容易とは言えないので、手順を分割します。

 3-2.~3-3.は1回目の試行、3-4.~3-5.は少し改良した2回目の試行です。


▼ 3-2. 着用品の抽出(1回目)

 はじめに、着用品だけの画像を作ります。

  • Generate image: 人物が着用しているものだけを並べてください。背景は白です。

画像から服だけを取りだした(2枚の画像を連結して掲載)

▼ 3-3. 着せ替え(1回目)

 続いて着せ替えを行います。注意点として、ベースの画像は最後に入力します。生成される画像の縦横比は基本的に、最後に入力した画像に合わせられるためです。

複数の画像とプロンプトを入力する
  • Generate image: 画像2のキャラクターに画像1を着せて

実行結果

 ログでは画像の表示順が入れ替わってしまい、少々混乱するかもしれません。本例ではうまい具合に着せ替えすることができました。

入力画像と出力画像(3枚の画像を連結して掲載)

 靴を変更したい場合は、服を抽出するときに靴も含めるようにするか、着せ替えの時に靴を指定すると良いでしょう。


▼ 3-4. 着用品の抽出(2回目)

 1回目では、画像を渡すだけでもほとんど意図どおりに着せ替えができました。より正確に、汎用的な着せ替えができるよう改めて試してみます。

 必ずしも想定どおりの出力にはならないので、新規のチャットで再試行したり、プロンプトを変更したりしてみてください。

  • Generate image (with no text): 人物が着用しているアイテムだけを資料化します。見た目のままで頭から足の順に並べて(左右に配置して良いです)、着ける部位の英字を書き込みます。アイテムはなるべく大きく表示してください。背景は白です。

画像から服だけを取りだした(2枚の画像を連結して掲載)

▼ 3-5. 着せ替え(2回目)

 続いて着せ替えを行います。靴やヘアピンも入れ替わるようプロンプトを調整しました。

  • Generate image: 画像2のキャラクターに画像1のアイテムを全部着せて、元々着けているものは全て外して

複数の画像とプロンプトを入力する

 服の変更だけではなく、スリッパから靴になり、ヘアピンも入れ替わっています。

着せ替え前後の比較(2枚の画像を連結して掲載)

 次の4.では、着用品の抽出を行わずに試行した例を挙げます。



■ 4. 人物や服の入れ替え(試行)

▼ 4-1. 概要

 3.の着せ替えを行う前に試行錯誤していた内容です。大したものではないので、「そうなんだ」程度に読み流していただいて結構です。

 出力の内容が不安定なため、同じ操作を行っても必ずしも期待どおりにはならない点を理解できればそれで良いと思います。割愛しますが、実は掲載した数以上に失敗しています。


▼ 4-2. 入れ替え1

 こちらは着せ替えに成功した例です。靴は入れ替わっていますが、ヘアピンはそのままです。

  • 画像1のキャラクターの服を完全に、画像2の服装に入れ替えて

画像1、画像2、出力画像

▼ 4-3. 入れ替え2

 画像1と2を入れ替えても同様の結果となりました。画像2は幅を詰めていますが、実際には正方形です。

  • Generate image: 画像2のキャラクターの服装を完全に、画像1の服装に入れ替えて

画像1、画像2、出力画像

 4-2.と4-3.の出力は似ているようでわずかに異なります。このような揺らぎは、常に起こり得るものとして受け入れるか、さらに指示を具体化する必要がありそうです。

2回の出力を並べた

▼ 4-4. 入れ替え3

 英語で「画像2のキャラクターの衣装を画像1の衣装に完全に置き換えます」と指示しました。スリッパがそのままになっています。

  • Please generate an image of the following (with no text respond): Completely replace the outfit of the character in image 2 with the outfit of image 1.

画像1、画像2、出力画像

▼ 4-5. 入れ替え4

 次は人物の入れ替えを試してみました。人物そのままで、着用品だけが入れ替わってしまいました(しかもブレザーが変になっている)。

  • Please generate an image of the following (with no text respond): 画像2のキャラクターを画像1と入れ替えます

画像1、画像2、出力画像

▼ 4-6. 入れ替え5

 4-5.の再試行です。今度は人物が入れ替わりましたが、スタイルは維持されています。プロンプトを調整することで、完全に入れ替えられる可能性はあります。

  • Please generate an image of the following (with no text respond): 画像2のキャラクターを画像1と入れ替えます

画像1、画像2、出力画像

▼ 4-7. 入れ替え6

 英語で「画像2のキャラクターを画像1と交換します(顔を除く)。」と指示したところ、首から下が入れ替わって人物が起立しました。

  • Please generate an image of the following (with no text respond): Swap the character in Image 2 with the one in Image 1 (except for the face).

画像1、画像2、出力画像

▼ 4-8. 入れ替え7

 4-7.を少し書き換えてポーズを変えないようにしたところ、スリッパが復活しました。

  • Please generate an image of the following (with no text respond): Swap the character in Image 2 with the character in Image 1 (except for the face and pose).

画像1、画像2、出力画像



■ 5. いろいろ1

▼ 5-1. 概要

 筆者がXにポストしたものです。載せたいものが少し残ったので、次回以降で掲載しようと思います。


▼ 5-2. 歩道橋にて

 下記の左の画像と、人物を含む画像の2枚を入力しました。人物が大きすぎたので、少し小さくなるようにしています。もう少しだけ小さくても良さそうです。

  • Generate image: やや小柄な人物が階段で振り返ってポーズをとっている

入力画像(背景分)、出力画像

▼ 5-2. キャラクターケーキ

 イラストが載ったケーキです。印刷したような味気ないイラストになってしまわないよう、少しだけ工夫を入れました。ポーズは具体的に表現した方が良いかもしれません。

  • Generate image: チョコペンや色付きのクリームなどを使った、人物の上半身を描いた手作りのホールケーキを上方向から撮影しました。人物はポーズをとっていて、周りにはお花などの背景をかわいく飾っています。ケーキの周囲も小物で彩っています。

イラスト入りのケーキ

▼ 5-3. マスゲーム

 おそらくできるだろうと思って試したものです。あいにく、3塁側にはなりませんでした。

  • Generate image: 野球の試合中に、応援席の3塁側で大規模なマスゲームをやって、人物の上半身と自然の風景が表現されています。

野球の応援席で巨大なイラストを再現



■ 6. いろいろ2

▼ 6-1. 概要

 筆者が思いつきで試してみたものです。


▼ 6-2. 色々な衣装のアイコン

 四角いアイコンを作ってみました。入力が横長なので縦2、横3にしています。SNS用の丸いアイコンにするのも良いかもしれません。

  • Generate image: 画像の人物の四角いアイコンを縦2行、横3列で可能な限り大きく、隙間無く並べます。人物のバストアップで、多彩な服装(セーラー、カジュアル、かわいいパジャマ、魔法少女、チアリーダー、天使)があり、ポーズも異なります。

人物からアイコンを作った

▼ 6-3. ケーキに乗せる

 立体にならないときは、「人物は全身で」を「人物は全身の立体で」に修正するといいかもしれません。

  • Please generate an image of the following:洋菓子店のパティシエが、イメージを踏襲した形でお菓子を作りました。人物は全身で靴を履いていて、着色された砂糖で形を作り、ホールケーキの上に置いてホイップクリームとお菓子の飾りを使っています。店のかわいいイートインのテーブルに置いて、お菓子の人物を接写しました。

ケーキの上に乗せてみた

▼ 6-4. ベリーダンス

 最後のおまけです。光を通す表現を入れると生地の透け感が演出できます。瞳がNano Bananaデフォルトの表現に寄ってしまう場合があるので、それを防ぐようにしています。

 今回は縦長にするために入力画像をトリミングしましたが、どうやら入出力の縦横比は一致しない場合があるようです。

  • Please generate an image of the following:シンプルな線とベタ塗りのテレビアニメ風の、特別なシーンのセルです。添付画像の人物(瞳を忠実に再現する)が髪型は維持したまま、生地に光が通る軽いベリーダンスの衣装で、上半身が映されています。身体を曲げ大きく動かして踊って微笑んでいます。背景はシチュエーションにあったパステルカラーの情景で、遠くに人の姿があります。

(※ 入力する画像によっては生成できない場合があります。プロンプトを少しずつ変更してみてください。)

入力画像と出力画像(エルフ娘のベリーダンス)
入力画像と出力画像(猫耳娘のベリーダンス)



■ 7. その他

 私が書いた他の記事は、メニューよりたどってください。

 記事に関することで何かありましたら、Xの@riddi0908までお願いします。

いいなと思ったら応援しよう!