此 ComfyUI 工作流旨在通过结合静态角色图片和音频文件,生成口型同步的视频。利用 Wan2.1 InfiniteTalk 模型,分析上传的音频,生成与语音内容匹配的口型动作,实现逼真的口型同步效果。流程从 'LoadAudio' 节点开始,导入音频文件并准备分析。同时,'LoadImage' 节点用于上传将被动画化的角色图片。工作流利用 'ComfyUI-WanVideoWrapper' 和 'audio-separation-nodes-comfyui' 等自定义节点处理音频并与视觉元素同步。最终输出为视频文件,通过 'SaveVideo' 节点保存,角色口型动作与音频轨道完美匹配。
在技术实现上,该工作流采用先进的音频分析和视频生成技术。'audio-separation-nodes-comfyui' 节点负责将音频分解为可映射到特定口型的成分,而 'comfyui-kjnodes' 节点则将这些动作与角色图片融合。此工作流特别适合内容创作者,无需复杂动画软件即可制作动画视频,是提升故事叙述和视觉媒体互动性的便捷工具。
API
通过代码使用此工作流
每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。
使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。
// Install (beta)
npm i @comfyorg/sdk
// Run "音频驱动角色口型同步视频" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("templates-wan2_1_infinitetalk_music_api.json");
const asset = client.assets.fromFile("input.png");
wf.setInput("284", "image", asset); // LoadImage
const job = await client.run(wf);
await job.getOutputs("325")[0].toFile("output.png"); // SaveVideoSDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。
常见问题
常见问题
Showing 30 of 30 templates













