私的AI研究会 > ComfyUI9e
画像生成AI「ComfyUI」9(音楽編)== 編集中 ==†
#ref(): File not found: "comfyui_247_m.jpg" at page "ComfyUI9e"
「ComfyUI」を使ってローカル環境でのAI音楽生成を検証する
▼ 目 次
▲ 目 次
※ 最終更新:2026/07/19
「ComfyUI」ACE-Step 1.5 による音楽生成†
| 「ACE-Step 1.5」を使って音楽を作成してみる |
- 「ACE-Step 1.5」とは
- StepFunとACE Studioが共同開発したオープンソースのAI音楽生成モデル
- 2026年2月3日〜4日にかけてオープンリリース
- テキストや既存の音声から、商用レベルの高品質な楽曲(ボーカル・伴奏入り)をわずか数秒で生成できる
- ACE-Step 1.5の主な特徴
- 完全ローカル動作: 月額料金が発生するSunoやUdioなどのクラウド型サービスとは異なり、自身のPCにモデルをダウンロードして無料で音楽を生成できる
- ハイブリッド・アーキテクチャ: 歌詞や要望から楽曲の構成(BPMや展開など)を計画する言語モデル(LM)と、
実際の音声を生成する拡散モデル(DiT)の2段構えを採用。長尺な曲でもメロディが崩れにくい設計になっている
- 高速生成: 高性能なGPU環境(A100など)であれば、4分間の楽曲を2秒未満で生成可能。ローカル環境でも数秒〜十数秒で出力できる
- 充実した編集機能: テキストからの生成だけでなく、既存の曲のメロディを引き継ぐ「カバー曲生成」や、一部だけを再生成する「リペイント(部分修正)」にも対応
- 日本語対応: 50以上の言語に対応しており、自然な日本語の歌詞での作曲も可能
- 商用利用可能: オープンソースライセンス(MITライセンスなど)で提供されているため、生成した楽曲を自由に利用・販売できる
- PC への導入には「ComfyUI」などのツールを利用するのが一般的であり、NVIDIA製GPU(VRAM 8GB以上推奨)を搭載したPC環境で利用できる
プロジェクトで作成するワークフロー†
| このプロジェクトで作成するワークフローと関連データは下記にアップロードしている(更新されている場合は再度ダウンロードのこと) |
音楽生成のための環境構築†
Step 1:オフシャルサイトのワークフロー†
更新履歴†
参考資料†