Hunyuan Video テキストから動画へ

このComfyUIワークフローは、TencentのHunyuan Videoモデルを使って、短いテキストプロンプトから一貫したマルチフレーム動画を生成します。最初に「Step1 - Load models」でモデルスタックを読み込みます。DualCLIPLoaderがテキストエンコーダを提供し、CLIPTextEncodeがポジティブ/ネガティブプロンプトを埋め込みに変換、UNETLoaderがHunyuan VideoのUNet weightsを読み込みます。ModelSamplingSD3がHunyuanのSD3風ノイズスケジュール用にサンプラーを構成し、FluxGuidanceがデノイズ中にclassifier‑free guidanceを適用します。「Step2 - Video size」ではEmptyHunyuanLatentVideoで幅・高さ・フレーム数/fps・durationを定義し、RandomNoiseで初期latent動画をseedします。続くCustom sampler(SamplerCustomAdvanced+KSamplerSelect+BasicScheduler)が、latent動画を反復的にデノイズして構造化されたアニメーションにします。

サンプリング後は、VAELoaderとVAEDecodeTiled(多くのGPUで推奨)またはVAEDecodeでlatentをRGBフレームに復元し、CreateVideoとSaveVideoで組み立てて書き出します。実用的な反復を意識した設計で、「Step3 - Prompt」でプロンプト文言を調整し、stepsやguidanceで忠実度と動きを調整できます。必要に応じてVAEDecodeTiledやUNETLoaderのfp8 weight_dtypeでメモリを管理します。Hunyuan Video固有の詳細やコツはリンク先ドキュメントを参照してください。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

hunyuan_video_text_to_video.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run "Hunyuan Video テキストから動画へ" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("hunyuan_video_text_to_video_api.json");

wf.setInput("44", "text", "your prompt here"); // CLIPTextEncode

const job = await client.run(wf);
await job.getOutputs("80")[0].toFile("output.png"); // SaveVideo

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates