私的AI研究会 > ComfyUI9f

画像生成AI「ComfyUI」9(動画編6) == 編集中 ==

 「ComfyUI」を使ってローカル環境でのAI画像生成を検証する

▲ 目 次
※ 最終更新:2026/08/14 

MinMax H3 による音声付き動画生成

 2026年7月発表されたテキスト、画像、動画、音声をひとつの文脈として同時に処理できる最新の汎用マルチモーダル動画生成AIモデルの検証

概要

プロジェクトで作成するワークフロー

 このプロジェクトで作成するワークフローと関連データは下記にアップロードしている(更新されている場合は再度ダウンロードのこと)

動画生成のための環境構築

  1. 必要モデルのダウンロード と配置
    モデル名ファイル名(.safetensors)配置先(/StabilityMatrix/Data/)ダウンロード URL利用先
    diffusion_modelsminimax_h3_fl2va_pruned_int8_convrotModels/DiffusionModels/minimax_h3_fl2va_pruned_int8_convrot.safetensors
    minimax_h3_ref2va_pruned_int8_convrotminimax_h3_ref2va_pruned_int8_convrot.safetensors
    text_encodersqwen3vl_32b_minimax_h3_nvfp4_awqTextEncodersqwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
    vaeminimax_h3_video_vae_fp16VAE/minimax_h3_video_vae_fp16.safetensors
    minimax_h3_audio_vae_fp32minimax_h3_audio_vae_fp32.safetensors

Step 1:オフィシャルサイトの標準テンプレートからワークフローを作成

 

更新履歴

 

参考資料