
このComfyUIチュートリアルワークフローは、1枚の画像から強いビジュアルアイデンティティと口パクの整合感を持つ短い音声付き動画を生成します。Lightricks LTX 2.3で動画生成、ID-LoRA(CelebVHQ)で顔やスタイリングの一貫性を維持し、Qwen 3 TTSで一致する音声トラックを作成します。パイプラインは「画像読み込み」「プロンプト作成」「プロンプト抽出」「音声作成」「動画作成」のグループで整理。
内部的には、GeminiNodeがアップロード画像(LoadImage経由)を解析し、表現タグ付きのセリフとシーン/外観説明の2つのテキストを生成。RegexExtractでID-LoRA用の3つのタグ付きセクション([VISUAL]、[SPEECH]、[SOUNDS])に分割します。FB_Qwen3TTSCustomVoiceは[SPEECH]と[SOUNDS]のスタイルヒントを使い音声トラックを合成し、SaveAudioMP3で保存。LTX 2.3動画ノード(本グラフのカスタムノード)は構造化プロンプトと参照画像を使いトーキング動画をレンダリング。CelebVHQ ID-LoRAは動きの多いシーンでもアイデンティティ保持を強化します。PreviewAnyで素早く確認し、SaveVideoで最終クリップを書き出します。ローカルユーザーはLTX空間アップスケーラー(ltx-2.3-spatial-upscaler-x2-1.1.safetensors)を使えば高解像度でより鮮明な出力も可能です。
API
このワークフローをコードから利用
すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。
Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。
FAQ













