该 ComfyUI 工作流使用 LTX-2.3 模型,将单张图像与一段语音录音转换为口型同步的说话视频。你用 LoadImage 加载一张人像,用 LoadAudio 提供语音,或用 RecordAudio 进行实时录制。两路输入会送入 LTX-2.3 生成节点(98ee9e5b-467b-40aa-a534-36033f27d0b4),它会合成一系列帧,使人物的说话节奏与音频同步。最终帧序列通过 SaveVideo 编码为 MP4。

从原理上看,LTX-2.3 会基于参考图像中的视觉身份信息,以及输入音频的时间特征,驱动口型与细微面部运动随时间变化。该节点通常提供输出分辨率和 FPS 等设置,许多版本还包含 seed 以便复现,并提供可选的文本提示词用于引导运动或风格。画面中的 MarkdownNote 记录了快速提示与官方 Lightricks 模型仓库链接,便于下载所需权重。

API

通过代码使用此工作流

每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。

video_ltx2_3_ia2v.json
正在获取工作流 JSON…

使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "LTX-2.3:图像音频转视频" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_ltx2_3_ia2v_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("269", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("341")[0].toFile("output.png"); // SaveVideo

SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。

Comfy Cloud API 访问需要包含 API 密钥的套餐。

常见问题

常见问题

查看所有工作流
Showing 30 of 30 templates