此工作流程以 LTX 2.3 與 Chatterbox 聲音轉換為核心,建立完整、開源的 lip-dub 管線。你需要提供一段人物說話的「driving」影片,以及希望他說出的對白。LoadVideo 讀入影片,GetVideoComponents 擷取影格、FPS 與原始音訊。你輸入的對白會從 PrimitiveStringMultiline 提示詞經 RegexReplace 清理標點與空白後,送入 LTX 2.3 Lipdub 節點(自訂節點 ID:1e1eaad5-a949-4d3e-9a68-694e64a936a0)。該節點會在 LTX 2.3 上套用 Lipdub LoRA 微調,讓口型依你的腳本重新對時,同時盡量保留主體身分、頭部動作與場景脈絡。

音訊部分,同一段對白會先生成臨時配音軌,再送入 FL_ChatterboxVC。Chatterbox VC 會以原影片音訊(由 GetVideoComponents 取得)作為聲音參考,將配音重塑為接近說話者的音色與聲學特徵。最後,CreateVideo 以來源 FPS 組合編輯後影格與克隆音訊,SaveVideo 輸出最終唇形同步影片。請注意 MarkdownNote 的尺寸規則:輸入寬 × 高要設為目標輸出的一半(例如輸入 960×544,輸出約為 1920×1088)。

API

從程式碼使用此工作流

每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。

e4ab88456b9b.json
正在取得工作流 JSON…

使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。

// Install (beta)
npm i @comfyorg/sdk

// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");

SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。

Comfy Cloud API 存取需有 API 金鑰的方案。

常見問題

常見問題

查看所有工作流
Showing 30 of 30 templates