見出し画像

HunyuanVideo FastVideo が速いことで失うものはやはりあって、それをどううまく使って行くか。

> プロンプトは CivitAI にあったものを流用しましたが、当方の世界と
> 馴染むかどうかもこれから試したいと考えます。
>(主にこの中共っぽい LoRA F1 を持前のものに置き換えて、この
> 高速 diffusion_models と親和性があるかどうかの観点です。) 

このように先の記事で記しましたが、やはり悪い直感は当たるもの
です。
当方の美人画の基本である LoRA F1、AsirAsianPhotographyflux.safe
tensors の効きが期待に沿いません。

outdoor, medium shot, wearing gray and black hard metal-suits, smiles, (very short bob cut hair), wide hip, large breasts, perfect slender young girl body, perfectly glossy skin ,25 yo mature girl, picture of a vivid, masterpiece, perfect lighting, asian beauty, The most amazing scene ever created , Fantasy art , Sci-Fi themes , Technological utopia , Another Planet , Timeless dimensions , Energy radiating everywhere , a Masterpiece, <lora:AsirAsianPhotographyflux:1.6>

まあなんとバタ臭い描写でしょうか。
(そもそも「バタ臭い」って何なんでしょうか)

The most amazing scene ever created , Fantasy art , などの背景も
無視されています。装甲の描写も如何にも手抜き感満載です。

night, outdoor, medium shot, wearing gray and black hard metal-suits, smiles, (very short bob cut hair), wide hip, large breasts, perfect slender young girl body, perfectly glossy skin ,25 yo mature girl, picture of a vivid, masterpiece, perfect lighting, asian beauty, masterpiece oil painting, landscape of a futuristic sci-fi moon base, gleaming metals and ceramics, cratered environment, dusty, thin haze, a large unknown dark striped planet dominating the skyline, <lora:AsirAsianPhotographyflux:1.6>

同じ LoRA F1 の効きでも背景プロンプトの違いで全体のタッチまで
変わってしまっています。masterpiece oil painting, が全体に波及して
しまっているのでしょうか。まるで書き割りのような背景です。

横構図に変更したら、まるで操り人形の動きみたいです。

outdoor, medium shot, wearing gray and black nano-suits, wide hip, large breasts, perfect slender young girl body, perfectly glossy skin ,25 yo mature girl, picture of a vivid, masterpiece, ,perfect lighting, asian beauty, Machine background ,spaceship outdoors background, Mecha Transport parts, dark and foggy environment, heavy fog environment, battlefield behind,
<lora:AsirAsianPhotographyflux:1.6>

気味悪さを禁じ得ません。

オリジナルの  HunyuanVideo と比べても、やはり速いのには意味がある、
というか速度を優先することで失うものはある、ということでしょう。
pyramidflow-miniflux(384p)が原画の背景詳細を吹っ飛ばして動画化
して、CogStudio より速い、と言われても「まあそりゃあ手抜きをすれば
速く出来るよね」としか思わないのと同じです。

オリジナルの  HunyuanVideo では AsirAsianPhotographyflux.safe
tensors には効果がありました。(厳密には静止画生成の際の
効き方とはやや違ってはいましたが。)

HunyuanVideo FastVideo が速度優先で表現力も維持するのは、
この hunyuan_vivi_model20.safetensors だけなのでしょうか。
どうにかこの中共ハニトラっぽい雰囲気を薄めることは出来ない
ものでしょうか。

同じプロンプトでも動きが自然です。装甲感は皆無ですが背景はしっかり
描かれています。

<lora:hunyuan_vivi_model20:1.2>

しかし当方はこの中共ハニトラ感が強烈に嫌なので、避けたいです。
静止画生成での fluxasiandoll_checkpointV10Clipvae.safetensors による
作画を思い出します。多くの画を生成してもテイストに嫌な統一感が
あった印象も同じです。

LoRA F1 を重ねてみました。

AsirAsianPhotographyflux.safetensors 単体でうまく生成出来ないなら、
hunyuan_vivi_model20.safetensors の修飾で基本的な部分を生成させて
AsirAsianPhotographyflux.safetensors でさらに修飾出来ないものか、
と考えました。静止画生成において背景周囲までを緻密に描く特質が
ある 2.5 次元 CheckPointファイル描画の上から Refiner 機能を使って
別の リアル系 CheckPoint ファイルの特質をかぶせるのに発想は似て
います。

<lora:hunyuan_vivi_model20:1.2> , <lora:AsirAsianPhotographyflux:1.4>

まだ前者の効きが強いようです。

<lora:hunyuan_vivi_model20:1.0> , <lora:AsirAsianPhotographyflux:1.6>

まだ不足気味です。
これではどうでしょうか。

<lora:hunyuan_vivi_model20:0.8> , <lora:AsirAsianPhotographyflux:1.8>

動きや背景の描き込みなどは狙いに近づいて来ましたが、先の記事のような
中共美女が街中で活き活きな自由度にはやや足りていないでしょうか。

AsirAsianPhotographyflux.safetensors 特有の美人像は得られていませんが、
修飾する CheckPoint F1 に相当する、 
hunyuan_video_FastVideo_720_fp8_e4m3fn.safetensors が
flux1-dev-bnb-nf4-v2.safetensors とは異なるものなので、致し方ないの
でしょう。

更に後者を強めて見ます。

<lora:hunyuan_vivi_model20:0.6> , <lora:AsirAsianPhotographyflux:2>

随分良くなってきました。
まあこれが自環境で 10 分ほどで生成される動画だ、というところを
含めると、まあ納得しようかとも思いました。
オリジナルの  HunyuanVideo とは表現が違うことを逆にうまく利用して
使い分ければ良いのでした。時間かけてもオリジナルの  HunyuanVideo
の描画が意図に向いていると考えるなら、そちらを選び、短時間の
試行錯誤で調整を追い込んでいくことを優先するならこちらを使えば
良いということです。

そこまで割り切れるほどには今回の試行錯誤で HunyuanVideo FastVideo
の「速度を優先することで失うものはある」を補えるようになったかなあ、
と考えます。

また HunyuanVideo FastVideo にも i2v の ComfyUI ワークフローの登場を
強く希望します。


ご覧いただきありがとうございます。



(2025/01/20 執筆)


いいなと思ったら応援しよう!