私的AI研究会 > ComfyUI16
画像生成AI「ComfyUI」16(実践編Ⅶ) == 編集中 == †
「ComfyUI」を使ってローカル環境でのAI画像生成を検証する
▼ 目 次
▲ 目 次
※ 最終更新:2026/06/28
『Boogu-Image-0.1』を検証する†
2026年6月16日に公開されたオープンソースの統合型マルチモーダル理解・画像生成AIモデルを検証してみる
「Boogu-Image-0.10」(ブーグ・イメージ)とは
画像生成AI「Boogu-Image-0.1」は特定の企業が開発したものではなく、「Boogu Project」というコミュニティや開発チームによってオープンソース(Apache 2.0ライセンス)として公開されているプロジェクト
実体は謎に包まれているが、公開されているソースコードの記述から、中国の著名なAI研究機関であるBAAI(北京智源人工知能研究院)のプロジェクト、あるいは同機関が開発した「OmniGen2」などをベースにした派生研究である可能性が高いと指摘されている
名前は「Boosting Open-Source Unified Multimodal Understanding and Generation」の略称で、最大 2048 × 2048 ピクセルの高解像度画像を生成・編集できる
主な特徴
モデルの構成: モデルはすべて10B(パラメータ数)規模であり、用途に合わせて以下の 3種類が用意されている
種別 steps sampler, scheduler 用途
Base 25~50 dpmpp_2m, simple 標準的な画像生成・理解モデル。
Turbo 4 lcm, sgm_uniform LCMなどのスケジューラーを活用し、わずか数ステップで高速に高品質な画像を生成するモデル。
Edit 25~50 dpmpp_2m, simple 画像の一部変更や衣服の着せ替えなど、高度な画像編集に特化したモデル。
高品質なマルチモーダル対応: 最大 2048 × 2048 ピクセルの高解像度画像に対応
ローカルでの高度な画像編集: 従来クラウド環境で主流だった「指定した要素の変更(例:白い服をライオンの着ぐるみに変更するなど)」を、ローカル環境でも手軽に行えるのが大きな強み
ローカル環境で画像生成や日本語での指示による画像編集を行いたい場合に注目されているモデル
プロジェクトで作成するワークフロー†
このプロジェクトで作成するワークフローと関連データは下記にアップロードしている(更新されている場合は再度ダウンロードのこと)
ワークフローと動作環境による生成時間(分:秒) 軽量版 推奨ワークフロー 軽量 GGUF版 推奨ワークフロー
画像生成のための環境構築†
必要モデルのダウンロード と配置
Step 1:標準テンプレート を検証する†
ComfyUI オフィシャルサイトで公開されているテンプレートのシード値を固定して再現性を確保し動かしながら整理する
いか確認することが推奨される
ワークフローを選ぶ
① 左端のメニューから「Template」を選択
②「Boogu」を選択する
・表示された一覧からワークフローを選ぶ
③「Boogu Turbo: Text to Image」Turbo版 Text to Image
・ワークフローでエラーが発生する場合は前項のモデルの配置を確認する
・生成画像 1024x1024
動作確認を行ってから保存する
・オリジナルのワークフロー
・テンプレートのオリジナル・ワークフローに対して「① モデルの変更, ② シード値を固定(同じ画像を再現できるように)」を変更する ・SubGraph の入力端子を減らし値を直接入力するようにして接続線を省略 ・生成途中画像表示と生成結果プレビュー画像表示の追加
Text to Image ワークフローText to Image ワークフロー SubGraph
「Boogu/」image_boogu_image_0_1_turbo_t2i.json
Text to Image ワークフローを整理する
オリジナルのワークフローを整理して FHD(1920x1080) 画面内に一括表示できるようにする
8101 基本ワークフロー 8101 SubGraph
Prompt:
Abstract close-up portrait of a young japanease woman wearing a cream turtleneck, captured with severe horizontal motion blur and double exposure effect that distorts his facial features, rendered in an analog film grain style with muted earthy background tones, framed tightly on his face to emphasize the blur streaks across his eyes, nose, and lips while retaining the texture of the knit collar and soft ambient lighting.
クリーム色のタートルネックを着用した若い日本人女性の、抽象的かつクローズアップなポートレート。顔の造作を歪ませるような強い水平方向のモーションブラーと多重露光(ダブル・エクスポージャー)の効果を加え、落ち着いたアースカラーを背景に、アナログフィルムの粒状感あるスタイルで表現しています。ニットの襟の質感や柔らかな環境光を活かしつつ、顔をタイトに切り取ることで、目・鼻・唇を横切るブラーの筋を際立たせています。
「Boogu/」8101_boogu_image_turbo_t2i.json
8102 基本ワークフロー(展開版)
Prompt:
20代の日本の若い女性のクローズアップポートレート。ナチュラルメイク、柔らかな表情。 85mmレンズ、f/1.4、浅い被写界深度、背景のボケ。 左から差し込む柔らかな窓の光、ゴールデンアワーの輝き、温かみのある肌色。 映画のような、リアルな、細部までこだわった、プロフェッショナルな写真。 注意点:彩度過度、アニメ調、低解像度、歪んだ顔。
「Boogu/」8102_boogu_image_turbo_t2i_simple.json
Step 2:英語/日本語プロンプトによる画像生成†
ChatGPT 生成のプロンプト → 英語/日本語 プロンプト
英語プロンプト 日本語プロンプト
① 20代の美しい日本人女性 1184x888
② 20代の美しい日本人女性、バストアップのアングル 1184x888
③ 夜のカフェでコーヒーを飲む日本人女性 1184x888
④ 背の高いエレガントなビジネスウーマン 1184x888
⑤ ミステリアスな27歳のプロモデル 1184x888
生成データ詳細
model boogu_image_turbo_fp8_scaled.safetensors, qwen3vl_8b_fp8_scaled.safetensors, ae.safetensors
steps 4
cfg 1.0
size (pixel) 1184x888, 888x1184, 1024x1024
seed 896977722960984
Workflow
8101_boogu_image_turbo_t2i.json SubGraph
更新履歴†
参考資料†