見出し画像

Qwen3-TTSチャレンジ

Qwen3-TTS - a Qwen Collection

CpmfyUI .1.0.0 Python 3.12.11 Pytorch 2.9.1+cu130の環境

ComfyUI-QWEN3_TTS インストールで再起動


" tts"検索で Qwen3 TTS Custom VoiceとQwen3 TTS Model Loader
Preview AudioとSave Audio追加

flash attention未インストールは use_flash_attn を " false "

デフォルト動作テスト


[Qwen3 TTS Custom Voice]

Seed(rgthee)の🎲New Fixed Randomで気に入った音声が出たら保存を有効にして再度生成して書き出していました。

[Qwen3 TTS Voice Design]

[Qwen3 TTS Voice Clone]

上のQwen3 TTS Custom Voiceをリファレンスにして

x-vector-onlyを有効にしました。

モデルを切り替える前に
keep_model_loadedを "false "で生成してアンロードすると
OOMが起きにくかったです。
そうやっても起きるときがありました。
あまり頻繁にモデルを切り替えないほうが安定するかもしれません。
とりあえず--reverse vram2も付けました。
あとfloat16等もあるようです。

Troubleshooting参照
https://github.com/PGCRT/ComfyUI-QWEN3_TTS#troubleshooting
(システムメモリ64GB,RTX5060Ti16GB)

以上です


いいなと思ったら応援しよう!