SVD 텍스트 기반 이미지 생성에서 이미지 기반 비디오 생성으로

ComfyUI의 'SVD Text to Image to Video' 워크플로는 텍스트 설명을 동적인 비디오 콘텐츠로 변환하도록 설계되었습니다. 이 과정은 CLIPTextEncode 같은 노드를 사용해 텍스트를 이미지 생성 모델이 해석할 수 있는 형식으로 인코딩하고, 텍스트 프롬프트에서 이미지를 생성하는 것부터 시작합니다. 워크플로는 SVD 및 Stability 같은 모델을 활용해 고품질 이미지 출력을 확보합니다. 이미지가 생성되면 SVD_img2vid_Conditioning 및 VideoLinearCFGGuidance 같은 노드를 사용해 정지 이미지를 유려한 비디오 시퀀스로 변환합니다. 이 워크플로는 복잡한 비디오 편집 기술 없이도 간단한 텍스트 입력만으로 비디오 콘텐츠를 만들고 싶은 크리에이터에게 유용합니다.

기술적으로 이 워크플로는 이미지와 비디오 모두의 품질과 일관성을 극대화하도록 구성되어 있습니다. KSampler 노드는 잠재 공간을 샘플링해 다양하고 창의적인 출력을 만드는 데 중요한 역할을 하며, VAEDecode 노드는 이러한 잠재 표현을 가시 이미지로 디코딩합니다. 이후 CreateVideo 노드가 이미지를 하나의 비디오로 결합하며, PreviewImage 및 SaveVideo 노드로 각각 미리보기 및 저장이 가능합니다. 이 접근은 효율적일 뿐 아니라 높은 수준의 커스텀과 창의적 제어를 제공해, 아티스트와 마케터 모두에게 유용합니다.

API

코드에서 이 워크플로우 사용하기

모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.

txt_to_image_to_video.json
워크플로우 JSON 불러오는 중…

Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.

// Install (beta)
npm i @comfyorg/sdk

// Run "SVD 텍스트 기반 이미지 생성에서 이미지 기반 비디오 생성으로" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("txt_to_image_to_video_api.json");

wf.setInput("18", "text", "photograph beautiful scenery nature mountains alps river rapids snow sky cumulus clouds"); // CLIPTextEncode

const job = await client.run(wf);
await job.getOutputs("24")[0].toFile("output.png"); // SaveVideo

SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.

Comfy Cloud API 접근은 API 키가 포함된 요금제가 필요합니다.

FAQ

자주 묻는 질문

모든 워크플로우 보기
Showing 30 of 30 templates