【アプリ開発:画像生成】ローカル画像生成非公式インストーラー&UI作ってみた【Codex&GPT】
(元日記)紹介動画も下に貼ってます。
みじんこの拡張機能作ってたけど単独で使えるようにしました。
配布ってどんな感じでやってるかも知らないのでお試し?で…
ForgeNeoを自動でセットアップして簡単にローカル画像生成使えます。
同梱じゃないけど自動でダウンロードと設定してくれます。
モデル(チェックポイント)は適当に探して準備しておいて下さいな。
動画嘘ついてます、モデル入れてもちゃんと選ばないと絵出ません><;
見てなんとなく使える、を目指します。
WINDOWSかつNvidia(RTX)専用になっちゃいました。
AMD持ってないんだ、テスト出来ないから作らなかったよ。
こんな感じ

初期状態だと安全タグが自動で入るようになってます(不可視)
安全機能使っても貫通する奴は貫通するのでおまじないだと思ってね。
生成設定はよくわからない数字も多いのでプリセットを設置
軽量、標準、高品質の3ボタンと自分で設定するカスタム設定を用意
モデル配置ボタン付けるのでそこから最初にモデル入れてください。
プレビュー下には過去の生成結果リストが並べられます
選択した画像をプレビューに表示、クリックすると拡大されます
保存はForgeのoutputsに入るのとは別に指定フォルダに気に入った画像を保存できます、チェックを入れれば設定詳細をjsonで画像と一緒に保存します
画像を生成するとお気に入り保存の上に生情報を表示するボタンが出るよ、seedとか確認するときに見たいよね。
お気に入りプロンプトは普段使うキャラクタープロンプト等を記録するのに便利かなーと思ってセーブ機能をつくりました
Lora呼び出しはちょっと考え中、作れる人はもう公式使えるかな?って。
普通にプロンプトで呼び出せるし無くても大丈夫かなー
みじんこワイルドカードは専用辞書を作って中のプロンプトを最大三種で3回ずつ抽選して自動挿入します
一応抽選結果は上部の説明に出ますが小さい
挿入ボタンで_mijinkoA_, って感じでプロンプトに入ります。
_mijinkoA_, _mijinkoA_, みたいにすると重複無しで6回まで抽選らしい
辞書は普通に書く、ペースト、テキストファイル読み込みで作れます。
一行1プロンプトやで。
クリアボタンは確認付きなので誤爆消去はないと思う、たぶん。
難しい機能が使いたくなったら公式UIを使ってください。
尚みじんこお絵描きでは公式UIまで設定できませんでした、ごめん
規約とかはインストール時に見ないと使えません、英語ですが。
BoothかGitHubで配布予定です。
開発中なので仕様が多少変わる可能性があります。
開発中アプリのカオスミジンコ123で動かしてます。
声はirodoriTSSって音声生成ソフトを使用してます。
視線移動等は演技タグで自動化してます
仕様書をAIに渡せば勝手にやってくれる^^b
差分変身もデキルヨ
楽しようとして実機映像のみだと見栄えが微妙にになっちゃうね
編集ソフトの勉強より色々作りたいを優先しちゃうんだよなー

codexさんいうこと聞くようになってくれたありがとうございます
おかげでお絵描き完成しそう、やっとカオスミジンコに戻れるヤッター
完成してもテストめんどくさー
うち4070と5080しかないからテスト不十分なんだよね
無料でぶん投げるんで使えたらラッキーくらいでお願いします。
たまに失敗しても何度か試せば通るケースもありました。
そのうちコントロールネットとか動画も対応予定ですけども
Loraはフォルダに突っ込んでタグ入れれば使えるので遊ぶには十分かなと。
そのうちComfyのワークフローの簡易表示UIとかも作りたい。
あ、GTX1660Tiノートで試したら対応してませんでした
専用環境作らないと使えなかったのでUIだけ使います。
カオスミジンコ123は余裕で使えた^^b
再来週でアプリはじめてから二ヵ月かぁ、あっという間だ。
