私的AI研究会 > ComfyUI9h
画像生成AI「ComfyUI」9(動画編7) == 編集中 ==†
「ComfyUI」を使ってローカル環境でのAI画像生成を検証する
▼ 目 次
▲ 目 次
※ 最終更新:2026/08/20
LTX-2.5 による音声付き動画生成†
| 2026年3月発表された音声対応の動画生成モデル。 |
- 「LTX-2.5」とは
・LTX-2.5とは、Lightricks社が公開した最新のオープンウェイトの動画生成AI(ワールドモデル)
・テキストや画像から、最大4K解像度・50 FPSの高品質な動画と同期した音声を高速に生成できるのが特徴で、ComfyUI などのローカル環境にも対応
- 主な特徴と進化点
- 同期オーディオ・ビデオ生成: 映像だけでなく、シーンに合った効果音や会話などの音声を同時に生成できる
- ネイティブマルチショット: 1回の生成で複数のカット(ショット)を繋いだ動画を作れ、キャラクターや照明の雰囲気を保てる
- Gemma 4 12B テキストエンコーダー: 複雑なプロンプトを正確に理解し、複数の被写体やカメラワークを維持
- プロンプトエンハンサー: 短い指示を自動で映画的な詳細なプロンプトに拡張する
プロジェクトで作成するワークフロー†
| このプロジェクトで作成するワークフローと関連データは下記にアップロードしている(更新されている場合は再度ダウンロードのこと) |
動画生成のための環境構築†
- 必要な拡張ノード → 拡張ノードの導入
- 必要モデルのダウンロード と配置
更新履歴†
参考資料†