
HuMo Video Generation 워크플로는 캐릭터의 입 모양을 오디오 입력과 동기화한 고품질 비디오를 생성하도록 설계되었습니다. 이 워크플로는 사람 중심 비디오 생성에 맞춰진 HuMo 모델을 활용합니다. 텍스트, 이미지, 오디오 등 다양한 입력 모달리티를 통합해 풍부하고 커스텀 가능한 비디오 출력을 제공합니다. 워크플로의 핵심에는 텍스트 처리를 위한 CLIPTextEncode, 참조 이미지를 위한 LoadImage, 오디오 입력을 위한 AudioEncoderEncode 같은 노드가 포함됩니다. 이는 CreateVideo 및 SaveVideo 같은 비디오 전용 노드와 결합되어 최종 출력을 생성합니다. WanHuMoImageToVideo 노드는 정적 이미지와 동적 비디오 생성을 연결하는 데 특히 중요하며, 캐릭터의 입 모양이 오디오 트랙과 정렬되도록 보장합니다. 이 워크플로는 정확한 립싱크와 시각적 커스텀이 필요한 몰입형 비디오 콘텐츠 제작에 적합합니다.
API
코드에서 이 워크플로우 사용하기
모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.
Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.
// Install (beta)
npm i @comfyorg/sdk
// Run "HuMo 비디오 생성" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_humo_api.json");
const asset = client.assets.fromFile("input.png");
wf.setInput("49", "image", asset); // LoadImage
wf.setInput("6", "text", "A young boy in sci-fi style clothing is talking to the camera in an alien desert."); // CLIPTextEncode
const job = await client.run(wf);
await job.getOutputs("59")[0].toFile("output.png"); // SaveVideoSDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.
FAQ













