見出し画像

Krea AI|学習キャラとポージングサイト画像でFlux生成した画像をNanoBananaと比較してみる

Gemini3のNanoBananaでいつものように生成した画像を基準に、Krea AIの「Image」と「Realtime」でFlux1.Kreaを使った生成画像と比較してみたので紹介します。

Gemini3 高速モード NanoBanana 作例
Krea AI Realtime 画像生成 & 編集 作例

Gemini3 NanoBananaで基準画像生成

いつものようにGemeni3のNanoBanana(高速モード)を立ち上げ、参照画像2枚(キャラクター、ポーズ)をアップロードし、以下のプロンプトを入力します。

最初にアップロードした画像のキャラクターで、2番目にアップロードした画像のポーズで、セーラー服を着た若い日本人女性が、日本の一般的な高校の教室で、友人に向かって「しー(黙って)」をしているシーンを描いてください。冬の夕方に窓から夕日が差し込んでいる背景で、カメラアングルは2番目にアップロードした画像を参照してください。

Gemini3 高速モード > キャラ+ポーズ+プロンプトで画像生成
画像生成完了 > ダウンロード

ダウンロードした画像が以下です。

PNG image 1.44 MB 992 × 1056 pix

一般的な画像生成AIによる生成画像として、この画像をKrea AIの生成画像と比較する基準にします。

Krea AIによる画像生成

Image

Gemini3(思考モード)で、Krea AIで同じ条件で画像生成させるためのプロンプト(英語、日本語)を以下のプロンプトで生成してもらいました。

Krea AIの「Image」で画像生成モデルに「Flux」、「Lora」にすでに学習したキャラクタースタイル、「Image Prompt」にポーズ画像を指定し、上記生成画像と同じ条件で画像生成するためのKrea用のプロンプトを英語と日本語で生成してください。

Geminiからの回答は以下のとおり:

英語版プロンプト:

A young Japanese woman with dark hair, the character from the LoRA, is in a Japanese high school classroom during a winter evening. She is making a "shh" gesture, finger to lips, towards a friend (out of frame), replicating the pose from image_0.png. She wears a dark blue sailor uniform with a pleated skirt and white socks. Warm, golden hour sunset light streams through the large classroom windows, illuminating dust motes in the air and casting long shadows. The classroom is full of wooden desks and chairs, a blackboard, and a clock on the wall. The atmosphere is nostalgic and warm.

日本語版プロンプト:

学習済みのLoRAキャラクターである、黒髪の若い日本人女性が、日本の高校の教室で冬の夕暮れ時に、image_0.pngのポーズで友人(画面外)に向かって「しー(黙って)」のジェスチャーをしている。彼女は紺色のセーラー服とプリーツスカート、白い靴下を着用している。大きな窓から暖かくオレンジ色の夕日が差し込み、空気中の埃を照らし、長い影を落としている。教室には木製の机と椅子、黒板、壁掛け時計がある。ノスタルジックで温かい雰囲気。

この英語版プロンプトをKrea AIのプロンプト窓にコピーし、「image_0.png」を「"Image prompt"」に変更。

Krea AI > Image

右下の「Generate」ボタンをクリックすると、数秒で4枚の画像が生成されました。

画像生成完了
PNG image 1.26 MB 1024 × 1024 pix
PNG image 956 KB 1024 × 1024 pix
PNG image 1.22 MB 1024 × 1024 pix
PNG image 807 KB 1024 × 1024 pix

キャラクターの一貫性とポーズはほぼ保たれていますが、プロンプトで指定したセーラー服や夕日が差し込む教室の雰囲気は表現されませんでした。

そこで、キャラクターとポーズの影響を最小限にし、再度生成してみると・・・

キャラクターとポーズの影響を最小限 > プロンプトを優先
PNG image 1.24 MB 1024 × 1024 pix

基準画像はこちら。

PNG image 1.44 MB 992 × 1056 pix

Realtime

上記のプロンプトはこちら:

A young Japanese woman with dark hair, the character from the LoRA, is in a Japanese high school classroom during a winter evening. She is making a "shh" gesture, finger to lips, towards a friend (out of frame), replicating the pose from image_0.png. She wears a dark blue sailor uniform with a pleated skirt and white socks. Warm, golden hour sunset light streams through the large classroom windows, illuminating dust motes in the air and casting long shadows. The classroom is full of wooden desks and chairs, a blackboard, and a clock on the wall. The atmosphere is nostalgic and warm.

リアルタイム用に以下のように修正:

krea, a young Japanese woman with dark hair, is in a Japanese high school classroom during a winter evening. She is making a "shh" gesture, finger to lips, towards a friend (out of frame). She wears a dark blue sailor uniform with a pleated skirt and white socks. Warm, golden hour sunset light streams through the large classroom windows, illuminating dust motes in the air and casting long shadows. The classroom is full of wooden desks and chairs, a blackboard, and a clock on the wall. The atmosphere is nostalgic and warm.

krea」は学習したキャラクター「EG-Kin」のトリガーワードをプロンプト内で使ったので、キャラクターの一貫性が期待できますが・・・

Realtime > プロンプトの指示のみで画像生成

Model」はデフォールトの「Realtime Edit」のままにしておきます。

Model > Realtime Edit

とりあえず、ポーズ画像をアップロードしてみました。

Upload Image > ポーズ画像

ポーズ画像に合わせてアニメ調に変わりましたが、ポーズは「しー」になりました。

そこで、基準画像をアップロードしてみます。

NanoBanana画像 > アップロード
PNG image 1.34 MB 1024 × 1024 pix

床に白い何か(雪?)が散らかっていますが、こういう使い方をすれば、手描きで生成画像をエディットできる可能性があります。

Krea AIによる手描きリアルタイム編集

3D変換

3D変換 > Convert to 3D

右クリックメニューのトップにある「Convert to 3D」を選択し、3D変換を試します。

3D変換後

3Dキャラクターをクリックすると、右側の画像が少し変化しました。

3Dキャラクターをクリック > 右側の画像が変化

3D回転

中央の3D回転アイコンをドラッグして、3Dキャラクターの角度を少し変えてみます。

3D回転
PNG image 1.38 MB 1024 × 1024 pix

回転前はこんな感じでしたが・・・

PNG image 1.34 MB 1024 × 1024 pix

3Dズーム&絞り?

3D回転アイコンの左右にあるアイコンもいじってみましたが、大きな変化はなく、顔の向きや姿勢が多少変化し、右端に男の生徒が現れたり・・・

3Dズーム & 絞り?
PNG image 1.37 MB 1024 × 1024 pix

驚きなのは、操作とほぼ同時に右側の画像が変化するので、従来の生成AIによる編集作業の待ち時間やガチャ要素によるストレスが無く、快適?にいじれます。

ただし、Kreaのリアルタイム編集は使いこなすのに時間がかかりそうなので、今後ある程度習得してから紹介したいと思います。

まとめ

Krea AIによる学習キャラクターとポーズ画像を用いた画像生成とリアルタイム編集を、Gemini3 高速モードのNanoBananaで生成した基準となる画像と比較してみたので、操作性とともに紹介しています。

今後は、AI生成画像のリアルタイム編集の習熟と、それを元にした一連の動画生成について紹介していきたいと思います。

参考リンク


いいなと思ったら応援しよう!