HuMo 视频生成

HuMo 视频生成工作流用于创建高质量视频,并将角色的嘴部动作与音频输入同步。该工作流使用 HuMo 模型,专为以人为中心的视频生成设计。通过整合多种输入模态——文本、图像和音频——它支持更丰富、可自定义的视频输出。核心节点包括用于文本处理的 CLIPTextEncode、用于参考图像的 LoadImage、用于音频输入的 AudioEncoderEncode,并与 CreateVideo、SaveVideo 等视频节点组合生成最终输出。WanHuMoImageToVideo 节点尤为关键,它连接静态图像与动态视频生成,确保角色口型与音频轨对齐。该工作流适合需要精确口型同步与画面定制的视频内容场景。

API

通过代码使用此工作流

每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。

video_humo.json
正在获取工作流 JSON…

使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "HuMo 视频生成" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_humo_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("49", "image", asset); // LoadImage

wf.setInput("6", "text", "A young boy in sci-fi style clothing is talking to the camera in an alien desert."); // CLIPTextEncode

const job = await client.run(wf);
await job.getOutputs("59")[0].toFile("output.png"); // SaveVideo

SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。

Comfy Cloud API 访问需要包含 API 密钥的套餐。

常见问题

常见问题

查看所有工作流
Showing 30 of 30 templates