
ComfyUI の「SVD Text to Image to Video」ワークフローは、テキスト説明から動きのある動画コンテンツへ変換するために設計されています。まず CLIPTextEncode などのノードでテキストをエンコードし、画像生成モデルが解釈できる形式にします。このワークフローは SVD や Stability などのモデルを活用して高品質な画像出力を得ます。画像が作成された後、SVD_img2vid_Conditioning や VideoLinearCFGGuidance などのノードで、静止画像を滑らかな動画シーケンスへ変換する生成をガイドします。高度な動画編集スキルなしで、簡単なテキスト入力から動画を制作したいクリエイターに適しています。
技術的には、画像と動画の品質および一貫性を最大化するよう構成されています。KSampler ノードは潜在空間のサンプリングを担い、多様で創造的な出力を生成するうえで重要です。VAEDecode ノードが潜在表現を可視画像へデコードします。CreateVideo ノードが画像を連結して動画にまとめ、PreviewImage と SaveVideo ノードでプレビューおよび保存が可能です。この手法は効率的で、カスタマイズ性も高く、アーティストやマーケターにとって有用です。
API
このワークフローをコードから利用
すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。
Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。
// Install (beta)
npm i @comfyorg/sdk
// Run "SVD テキストから画像へ 画像から動画へ" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("txt_to_image_to_video_api.json");
wf.setInput("18", "text", "photograph beautiful scenery nature mountains alps river rapids snow sky cumulus clouds"); // CLIPTextEncode
const job = await client.run(wf);
await job.getOutputs("24")[0].toFile("output.png"); // SaveVideoSDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。
FAQ













