此ComfyUI工作流通过将LTX-2.3与三种输入条件结合,实现个性化、口型同步的视频片段生成:参考图像(外观)、短音频片段(时序与语音风格)以及结构化提示(场景、台词和声音环境)。核心逻辑封装在一个子工作流(自定义节点ID为98ee9e5b-467b-40aa-a534-36033f27d0b4)中,协调LTX-2.3与ID-LoRA的身份适配。LoadImage节点提供面部/姿态参考,LoadAudio或RecordAudio节点输入语音,SaveVideo节点输出最终视频。画布中的MarkdownNote总结了结构化提示格式,并链接到LTX-2.3和ID-LoRA资源。

技术上,ID-LoRA在LTX-2.3视频扩散过程中注入轻量级身份适配器,使生成的人物与参考图像一致,无需完整微调。提示被拆分为子工作流所需的三类标签:[VISUAL](场景与外观)、[SPEECH](具体台词)、[SOUNDS](说话风格与环境提示)。音频驱动口型和时序,[SPEECH]标签帮助模型在音素级别实现更清晰的口型。最终结果是目标人物按参考图像外观、与音频同步地说出指定台词的短视频。

API

通过代码使用此工作流

每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。

video_ltx2_3_id_lora.json
正在获取工作流 JSON…

使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "LTX-2.3:ID LoRA" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_ltx2_3_id_lora_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("269", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("341")[0].toFile("output.png"); // SaveVideo

SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。

Comfy Cloud API 访问需要包含 API 密钥的套餐。

常见问题

常见问题

查看所有工作流
Showing 30 of 30 templates