HuMo ビデオ生成

HuMoビデオ生成ワークフローは、キャラクターの口の動きを音声入力と同期させた高品質な動画を作成するために設計されています。このワークフローは、人物中心の動画生成に特化したHuMoモデルを活用しています。テキスト、画像、音声など複数の入力形式を統合することで、柔軟でカスタマイズ可能な動画出力が可能です。ワークフローの中心には、テキスト処理用のCLIPTextEncode、参照画像用のLoadImage、音声入力用のAudioEncoderEncodeなどのノードが含まれています。これらはCreateVideoやSaveVideoなどの動画生成ノードと組み合わせて最終出力を作成します。特にWanHuMoImageToVideoノードは、静止画像と動画生成をつなぐ重要な役割を果たし、キャラクターの口の動きが音声トラックと正確に一致するようにします。このワークフローは、リップシンクやビジュアルのカスタマイズが求められる魅力的な動画コンテンツの作成に最適です。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

video_humo.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run "HuMo ビデオ生成" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_humo_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("49", "image", asset); // LoadImage

wf.setInput("6", "text", "A young boy in sci-fi style clothing is talking to the camera in an alien desert."); // CLIPTextEncode

const job = await client.run(wf);
await job.getOutputs("59")[0].toFile("output.png"); // SaveVideo

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates