本工作流围绕 LTX 2.3 和 Chatterbox 声音转换构建完整开源唇语配音流程。你需提供一段人物说话的“驱动”视频,以及希望其说出的台词。LoadVideo 节点导入视频,GetVideoComponents 提取帧、帧率和原始音频。输入台词通过 PrimitiveStringMultiline 节点,经 RegexReplace 清理标点和空格后,送入 LTX 2.3 唇语配音节点(ID 1e1eaad5-a949-4d3e-9a68-694e64a936a0)。该节点用唇语 LoRA 微调 LTX 2.3,实现口型与台词同步,同时保留人物身份、头部动作和场景。
音频部分,台词生成临时配音轨,再传递给 FL_ChatterboxVC。以原视频音频(来自 GetVideoComponents)为声音参考,Chatterbox VC 将配音转换为原说话人音色。最后,CreateVideo 节点将编辑后的视频帧与克隆音频按原帧率合成,SaveVideo 节点导出最终唇语配音视频。注意 MarkdownNote 中的尺寸规则:输入宽高需为目标输出的一半(如输入 960×544,输出约 1920×1088)。
API
通过代码使用此工作流
每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。
使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。
常见问题













