私的AI研究会 > ComfyUI_Rebuild

画像生成AI「ComfyUI」再構築

 「ComfyUI」を使ってローカル環境でのAI画像生成を検証する

▲ 目 次
※ 最終更新:2026/07/21 

「ComfyUI」再導入

 「ComfyUI」は現在、毎日数回の更新が行われている活発なプロジェクトであり本サイト上の情報は確認時点のものであることに注意すること。
 操作方法や結果に齟齬がある場合は情報の時期を確認してください。

これまでの検証経緯

 2025年3月より SD1.5 モデルを中心に「ComfyUI」の検証を行ってきた。11月頃より新しいモデルが続々と登場してくるとともに「ComfYUI」本体とその周辺環境も大きく変化している。従来必須だった拡張ノードや便利な機能が標準搭載され、それに対応した環境構築手順の変更も少なくない
・現時点(2026年7月)の「ComfyUI」環境構築手順を新しくまとめ直しこれからの検証に対応できるようにする

Step 1:「ComfyUI」パッケージの新規インストール

インストールが簡単・モデルファイルの共用・メンテナンスの容易さなどから「Stability Matrix」環境を利用する
  1. 「Stability Matrix」画面下の「+ パッケージの追加」を押す

  2. 画面をスクロールして「ComfyUI」を選択する
    ・すでに「ComfyUI」インストール済みの場合は、別の名称で複数インストールできる
    ・インストールには時間がかかる(数分~数十分)

  3. インストールが終了すると画面に「ComfyUI」パッケージが追加される










  4. 起動設定をする

    ①「Launch Options」(歯車アイコン)を押す
    ②「--auto_launch」にチェックを入れる(自動的にページを開く設定)
    ③「--enable_manager」のチェックを外す(ComfyUI-Manager(V4) を使わない設定)
    ④「保存」を押す

    ※ NVIDIA GPU 未搭載の場合は「--cpu」をチェックする
    ※ ComfyUI-Manager を標準のまま(V4) で使う場合は下記の設定をする
     ・「--enable_manager」のチェックを入れる
     ・「Extra Launch Argument」に「 --enable-manager-legacy-ui 」を設定

  5. 「ComfyUI-Manager」をインストールする(V4 を使用する場合は不要)

    ①「Extentions」(パズルアイコン)を押す
    ② ダイアログの検索入力に「 ComfyUI-Manager 」と入れて検索
    ③「ComfyUI-Manager」パッケージにチェックを入れる

    ④「インストール」ボタンを押してインストールする

  6. 「transformas」パッケージのダウングレード(必要がある場合のみ実行)

    ① パッケージ・ウインドウ右上のメニューから「Pythonパッケージ」を選択
    ② 検索窓に「 transform 」を入力する
    ・現在インストールされているバージョンが表示される

    ③「+」ボタンを押す
    ④ 表示された入力欄の pip install の後に「 transformers==4.57.6 」と入力
    ⑤「OK」ボタンを押す
    ・指定のバージョンがインストールできる
    ・メニューから「アップデートチェックを無効にする」にチェックを入れる

  7. 「Launch」ボタンを押して「ComfyUI」起動する
    ・初回の起動はやや時間を要する(数分~数十分)

Step 2:「ComfyUI」環境設定

 デフォールト設定のままでは以降の手順に齟齬が生じるので設定を変更する
  1. ローカライズの設定(日本語デフォールト)変更
    ① ComfyUI 画面左下①設定ボタンを押し、ローケールの言語を「English」に変更する

  2. Seed値 固定時の動作設定
    ・画像を生成した結果表示されているシード値を固定して、各種変更を加えた後同じシード値で生成する
    ・このような場合デフォールトではうまくいかないので以下の設定変更を行う
    ①「Settings」の「Node Widget」→ Widget control mode を「befor」に設定する
    ・「before」:プロンプトをキューに入れるときにシードがランダム化され、サンプラー設定に表示されるシードは現在の生成のシードになる
     シードが気に入ったら、固定に変更して、そのシードで生成を続ける

  3. 接続線の中間点を矢印にする

    ①「Setting」メニューから「Lite Graph」タブを選択
    ②「Link」項目のリストから「Arrow」を選ぶ

Step 3:その他の設定項目

「ComfyUI」では日々の更新に伴い、インストール後に設定する必要があった項目がデフォールトでサポートされるようになった
 現在未サポートの項目を記載する(その後の更新で設定の必要がなくなるかもしれない)

Step 4:プロジェクトで使用するワークフローの導入

  1. ワークフロー一式(①②③すべて)をダウンロードする
    ComfyUI_proj.zip    「ComfyUI」01~08
    ComfyUI_ex_proj.zip   「ComfyUI」09~15
    ComfyUI_ex2_proj.zip  「ComfyUI」16~

  2. 解凍してできる「ComfyUI/」フォルダの中身ををパッケージ・フォルダ(例:「StabilityMatrix/Data/Packages/ComfyUI」)へ上書きコピーする
    📂ComfyUI
      ├─📂input              ← ワークフローに含まれる入力画像
      └─📂user
            └─📂default
                  └─📂workflows        ← ワークフロー
                            :

Step 5:「ComfyUI」拡張ノードの導入

 拡張ノードは必要となった時(ワークフロー読み取り時エラーが発生したとき)下記手順で適宜インストール可能(一部は直接フォルダコピーで配置するものもある)
 

今後の検証プロジェクト(参考)

次節以降のテーマ

必要モデル

推奨ワークフロー 

フォルダワークフロー名 (.json)モデル機能 (参照ページ)特記事項(同じ機能のワークフロー .json)
SDXL1111_sdxl_t2i_baseSDXLText To Image 基本ワークフロー(base-sdxl)
1112_sdxl_t2i_hiresnText To Image 高解像度 (hires.fix)(bs_text2img_hires)
1113_sdxl_i2i_baseImage To Image 基本ワークフロー(bs_img2img)
1114_sdxl_i2i_inpaintInpaint ワークフロー(i2i_inpaint)
1115_sdxl_i2i_outpaintOutpaint ワークフロー(bs_i2i_outpaimt)
1116_sdxl_t2i_controlnetControlNet ワークフロー(t2i_controlnet_openpose)
1117_sdxl_ipadapter_baseIPAdapter ワークフロー(test_ipadapter_base)
1118_sdxl_illust_to_real画像のスタイル変換(i2i_stylechange)
Z-image2200_z_image_turbo_t2i蒸留版
nvfp4
Text to Image 基本フロー(蒸留版)(image_z_image_turbo) 改訂版
2201_z_image_turbo_t2i_simple T2I 基本フロー(蒸留版・展開版)2200 展開版
2202_z_image_turbo_i2iImage to Image 基本フロー(蒸留版)Z-Image-Tuabo Image to Image 基本フロー
2203_z_image_turbo_i2i_simple I2I 基本フロー(蒸留版・展開版)2202 展開版
2102_z_image_turbo_controlnetコントロールネットで画像を制御Z-Image-Turbo コントロールネット
2191_z_image_turbo_auto日本語プロンプトで画像生成>2101_z_image_turbo_simple + 日本語プロンプト入力
2210_z_image_base_t2i通常版
bf16
Text to Image 基本フロー(通常版)(image_z_image_base) 改訂版
2211_z_image_base_t2i_simple T2I 基本フロー(通常版・展開版)2210 展開版
2212_z_image_base_i2iImage to Image 基本フロー(通常版)Z-Image-base Image to Image 基本フロー
2213_z_image_base_i2i_simple I2I 基本フロー(通常版・展開版)2212 展開版
FLUX3101_flux1_schnell_simpleschnel
fp8
Text To Image 基本フロー KSampler(3111_flux1_schnell_simple)
3102_flux1_schnell_ctrlnetControlNet ワークフロー KSampler(3112_flux1_schnell_controlnet)
3111_flux1_schnell_simpleText To Image 基本ワークフローFLUX.1 schnel
3112_flux1_schnell_controlnetControlNet ワークフローFLUX.1 schnel コントロールネット
3201_flux2_klein_distilledklein
蒸留版
fp8
基本ワークフロー(蒸留版)KSampler(3211_flux2_klein_distilled)
3211_flux2_klein_distilled基本ワークフロー(蒸留版)FLUX.2 klein(蒸留版) 基本フロー
3230_flux2_klein_image_edit_distilled 画像編集 (1 画像)FLUX.2 klein(蒸留版) 1 画像編集
3231_flux2_klein_image_edit_distilled 画像編集 (2 画像)FLUX.2 klein(蒸留版) 2 画像編集
3301_flux2_klein_baseklein
base版
fp8
基本ワークフロー(base版)KSampler(3311_flux2_klein_base)
3311_flux2_klein_base基本ワークフロー(base版)FLUX.2 klein(base版) 基本フロー
3330_flux2_klein_image_edit_base 画像編集 (1 画像)FLUX.2 klein(base版) 1 画像編集
3331_flux2_klein_image_edit_base 画像編集 (2 画像)FLUX.2 klein(base版) 2 画像編集
ERNIE4100_ernie_image_t2i通常版Text to Image + Prompt EnhancerComfyUI テンプレート (image_ernie_image.json)
4101_ernie_image_t2i_simpleText to Image 展開版Prompt Enhancer なし
4102_ernie_image_t2i_generalText to Image 汎用版4101 SubGraph 版
4103_ernie_image_i2i_simpleImage to Image 基本フロー(通常版)Image to Image 基本フロー
4104_ernie_image_i2i_general I2I 基本フロー(通常版・展開版)4103 展開版
4200_ernie_image_turbo_t2i蒸留版
fp8
Text to Image + Prompt EnhancerComfyUI テンプレート (image_ernie_image_turbo.json)
4201_ernie_image_turbo_t2i_simpleText to Image 展開版Prompt Enhancer なし
4202_ernie_image_turbo_t2i_generalText to Image 汎用版4201 SubGraph版
4203_ernie_image_turbo_i2i_simpleImage to Image 基本フロー(蒸留版)Image to Image 基本フロー
4204_ernie_image_turbo_i2i_general I2I 基本フロー(蒸留版・展開版)4203 展開版
HiDream-O17000_hidream_o1_agent_full通常版
fp8
full(通常版)基本ワークフロー(image_hidream_o1_org.json) プロンプト拡張
7001_hidream_o1_fullfull(通常版)基本ワークフロー(image_hidream_o1_org.json)
7002_hidream_o1_full_simplefull(通常版)Simple ワークフロー7001 展開版
7010_hidream_o1_full_t2ifull(通常版) Text to Image7002
7011_hidream_o1_full_itifull(通常版) Image to Image7002
7100_hidream_o1_agent_dev蒸留版
nvfp8
dev(蒸留版)基本ワークフロー(image_hidream_o1_dev_org.json) プロンプト拡張
7100v2_hidream_o1_agent_devdev(蒸留版)基本ワークフロー(image_hidream_o1_dev_org.json) 日本語プロンプト拡張
7101_hidream_o1_devdev(蒸留版)基本ワークフロー(image_hidream_o1_dev_org.json)
7102_hidream_o1_dev_simpledev(蒸留版)Simple ワークフロー7101 展開版
7110_hidream_o1_dev_t2idev(蒸留版) Text to Image7102
7111_hidream_o1_dev_itidev(蒸留版) Image to Image7102
Ideogram8000_ideogram4_prompt蒸留版
fp8
LLM入力プロンプト作成(image_ideogram4_t2i_org.json) LLM プロンプト
8001_ideogram4_t2iText to Image 基本ワークフロー(image_ideogram4_t2i_org.json) Text to Image
8002_ideogram4_t2i_simpleText to Image 展開版ワークフロー8001 展開版
8010_ideogram4_t2i_KJBuilderJSON プロンプトを視覚的に操作Ideogram 4 Prompt Builder KJ 拡張ノード
8011_ideogram4_t2i_PromptGent2i プロンプト・ジェネレータ含む
Boogu8101_boogu_image_turbo_t2i蒸留版
fp8
Text to Image 基本ワークフロー(image_boogu_image_0_1_turbo_t2i.json)
8102_boogu_image_turbo_t2i_simpleText to Image 展開版ワークフロー8101 展開版
8103_boogu_image_turbo_i2iImage to Image 基本 (簡略版)8101 Image to Image
8104_boogu_image_turbo_i2i_simpleImage to Image 展開版 (簡略版)8103 展開版
Krea8201_krea2_turbo_t2i蒸留版
fp8
Text to Image 基本ワークフロー(image_krea2_turbo_t2i_org.json
8202_krea2_turbo_t2i_simpleText to Image 展開版ワークフロー8201 展開版
8203_krea2_turbo_t2iText to Image 基本フロー (簡略版)8201 プロンプトエンハンサーなし
8204_krea2_turbo_t2i_simpleText to Image 展開版フロー (簡略版)8202 プロンプトエンハンサーなし
8205_krea2_turbo_i2iImage to Image 基本 (簡略版)8203 Image to Image
8206_krea2_turbo_i2i_simpleImage to Image 展開版 (簡略版)8205 展開版
LTX5100_LTX2_t2v_dev通常版
fp4
テキストから動画生成 (通常版 fp4)(video_ltx2_t2v_dev_003)
5101_LTX2_i2v_dev静止画から動画生成 (通常版 fp4)(video_ltx2_i2v_dev_003)
5102_LTX2_t2v_dev_simpleテキストから動画(通常展開版 fp4)(101_T2V_LTX2_base_distilled)
5103_LTX2_i2v_dev_simple静止画から動画(通常展開版 fp4)(102_I2V_LTX2_base_distilled)
5200_LTX2_t2v_distilled蒸留版
fp8
テキストから動画生成(蒸留版 fp8)(video_ltx2_t2v_001)
5201_LTX_i2v_distilled静止画から動画生成(蒸留版 fp8)(video_ltx2_i2v_001)
5202_LTX2_t2v_distilled_simpleテキストから動画(蒸留展開版 fp8)(103_T2V_LTX2_base_dev)
5203_LTX_i2v_distilled_simple静止画から動画(蒸留展開版 fp8)(104_I2V_LTX2_base_dev)
5240_LTX2_t2v_distilled_GGUFGGUFText to Video (GGUF)5242 SubGraph版
5241_LTX2_i2v_distilled_GGUFImage to Video (GGUF)5243 SubGraph版
5242_LTX2_t2v_distilled_simple_GGUFText to Video (展開版)5240 展開版
5243_LTX2_i2v_distilled_simple_GGUFImage to Video (展開版)5241 展開版
5291_LTX2_i2v_distilled_auto蒸留版LTX-2 自動プロンプト5201_LTX_i2v_distilled + 日本語プロンプト入力
LTX5300_LTX-2.3_t2v_dev通常版
fp8
Text to Video 基本ワークフロー(video_ltx2_3_t2v.json) オフィシャル版
5301_LTX-2.3_i2v_devImage to Video 基本ワークフロー(video_ltx2_3_i2v.json) オフィシャル版
5302_LTX-2.3_t2v_dev_simpleText to Video 基本(simple)5300 展開版
5303_LTX-2.3_i2v_dev_simpleImage to Video 基本(simple)5301 展開版
5304_LTX-2.3_T2V_I2V_1st_devText/Image to Video (dev)LTX-2.3_T2V_I2V_Single_Stage, Lightricks オフィシャル
5310_LTX-2.3_ia2v_devImage Audio to Video 基本ワークフロー(video_ltx2_3_ia2v.json) オフィシャル版
5311_LTX-2.3_ia2v_dev_simpleImage Audio to Video 基本(simple)5310 展開版
5340_LTX-2.3_t2v_dev_GGUF通常版
GGUF
Text to Video (GGUF)5342 SubGraph版
5341_LTX-2.3_i2v_dev_GGUFImage to Video (GGUF)SubGraph Rebels LTX-2.3 Dev (GGUF)
5342_LTX-2.3_T2V_dev_GGUFText to Video (GGUF 展開版)241_LTX2.3_T2V_GGUF GGUF WORKFLOWS 12GB
5343_LTX-2.3_I2V_dev_GGUFImage to Video (GGUF 展開版)242_LTX2.3_I2V_GGUF GGUF WORKFLOWS 12GB
5344_LTX-2.3_T2V_I2V_1st_dev_GFText/Image to Video (GGUF dev)5304 GGUF
5350_ltx-2.3_ia2v_dev_GGUFImage Audio to Video (GGUF)5310 GGUF
5351_ltx-2.3_ia2v_dev_GGUFImage Audio to Video (GGUF 展開版)5311 GGUF
5400_LTX-2.3_t2v_distilled蒸留版
fp8
Text to Video 基本ワークフロー5300 蒸留版
5401_LTX-2.3_i2v_distilledImage to Video 基本ワークフロー5301 蒸留版
5402_LTX-2.3_t2v_distil_simpleText to Video 基本(simple)5302 蒸留版
5402v2_LTX-2.3_t2v_distil_simple
5403_LTX-2.3_i2v_distil_simpleImage to Video 基本(simple)5303 蒸留版
5403v2_LTX-2.3_t2v_distil_simple5403 最終フレーム保存
5404_LTX-2.3_T2V_I2V_1st_distilledText/Image to Video 1stage (蒸留版)LTX-2.3_T2V_I2V_Single_Stage, Lightricks オフィシャル
5405_LTX-2.3_T2V_I2V_2st_distilledText/Image to Video 2stage (蒸留版)LTX-2.3_T2V_I2V_Two_Stage, Lightricks オフィシャル
5406_LTX-2.3_t2v_3st_distilledText To Video 3stage (蒸留版)LTX-2.3_text2video_distilled_3stage
5407_LTX-2.3_i2v_3st_distilledtImage To Video 3stage (蒸留版)LTX-2.3_image2video_distilled_3stage
5408_LTX-2.3_a2v_3st_distilledAudio To Video 3stage (蒸留版)LTX-2.3_audio2video_distilled_3stage
5410_LTX-2.3_ia2v_distilledImage Audio to Video (蒸留版)5310 蒸留版
5411_LTX-2.3_ia2v_distilled_simpleImage Audio to Video (蒸留版 simple)5311 蒸留版
5412_LTX-2.3_flf2v_distilledFLF2V (蒸留版)(video_ltx2_3_t2v.json)
5413_LTX-2.3_flf2v_distilled_simpleFLF2V (蒸留版 simple)(video_ltx2_3_i2v.json)
5414_LTX-2,3_trans_distilledStyle Transition (蒸留版)(video_ltx2_3_ia2v.json)
5415_LTX-2,3_trans_distilled_simpleStyle Transition (蒸留版 simple)(video_ltx2_3_flf2v.json)
5416_LTX-2.3_id_lora_distilledID LoRA (蒸留版)(template_ltx2_3_style_transition.json)
5417_LTX-2.3_id_lora_distilled_simpleID LoRA (蒸留版 simple)(video_ltx2_3_id_lora.json)
5440_LTX-2.3_t2v_distilled_GGUF蒸留版
fp8
Text to Video (GGUF)5400 GGUF
5441_LTX-2.3_i2v_distilled_GGUFImage to Video (GGUF)5401 GGUF
5442_LTX-2.3_T2V_distilled_GGUFText to Video (GGUF 展開版)5402 GGUF
5443_LTX-2.3_I2V_distilled_GGUFImage to Video (GGUF 展開版)5403 GGUF
5444_LTX-2.3_T2V_I2V_1st_distil_GFText/Image to Video 1stage (GGUF蒸留版)5404 GGUF
5445_LTX-2.3_T2V_I2V_2st_distil_GFText/Image to Video 2stage (GGUF蒸留版)5405 GGUF
5446_LTX-2.3_t2v_3st_distiled_GFText To Video 3stage (GGUF 蒸留版))5406 GGUF
5447_LTX-2.3_i2v_3st_distiled_GFImage To Video 3stage (GGUF 蒸留版))5407 GGUF
5448_LTX-2.3_a2v_3st_distiled_GFAudio To Video 3stage (GGUF 蒸留版))5408 GGUF
5450_ltx-2.3_ia2v_distilled_GGUFImage Audio to Video (GGUF)5410 GGUF
5451_ltx-2.3_ia2v_distilled_GGUFImage Audio to Video (GGUF 展開版)5411 GGUF
5452_LTX-2.3_flf2v_distilled_GGUFFLF2V (GGUF 蒸留版)5412 GGUF
5453_LTX-2.3_flf2v_distilled_GGUFFLF2V (GGUF 蒸留版 simple)5413 GGUF
5454_LTX-2,3_trans_distilled_GGUFStyle Transition (GGUF 蒸留版)5414 GGUF
5455_LTX-2,3_trans_distilled_GGUFStyle Transition (GGUF 蒸留版 simple)5415 GGUF
5456_LTX-2.3_id_lora_distilled_GGUFID LoRA (GGUF 蒸留版)5416 GGUF
5457_LTX-2.3_id_lora_distilled_GGUFID LoRA (GGUF 蒸留版 simple)5417 GGUF
5491_LTX-2.3_i2v_distilled_auto蒸留版 fp8LTX-2.3 自動プロンプト5401_LTX-2.3_i2v_distilled + 日本語プロンプト入力
_audio6001_Qwen3_custom_voiceQwen3-TTSText to Speechテキストから音声合成
6002_Qwen3_voice_cloneVoice clone Text to Speech参照音声を話し手としてテキストから音声合成
6003_Qwen3_simple_voice_cloneVoice clone Text to Speech with ASR参照音声を話し手として発話内容を解析しテキストから音声合成
6004_Qwen3_voice_designText to Speech with Voise Designプロンプトで指定した話し手の声で テキストから音声合成
6005_Qwen3_speech_recogAutomatic Speech Recognition参照音声から発話内容を解析して テキストとして表示
6010_Qwen3_voice_designVoise Design / Text to Speechプロンプトで話し手の声を設計 / 設計した声で テキストから音声合成
 

忘備録

「ComfyUI Manager」について

 

更新履歴

 

参考資料