LTX 2.3_ID_lora_CelebVHQ

이 ComfyUI 튜토리얼 워크플로는 단일 이미지를 짧은 음성 기반 비디오로 변환하며, 강한 시각적 아이덴티티와 자연스럽게 느껴지는 립 얼라인을 목표로 합니다. 비디오 생성에는 Lightricks LTX 2.3을 사용하고, ID-LoRA(CelebVHQ)를 통해 프레임 전반에서 피사체의 얼굴 및 스타일링 일관성을 유지하며, Qwen 3 TTS가 어울리는 보이스 트랙을 생성합니다. 파이프라인은 Load Image, Create Prompts, Prompt Extraction, Create Voice, Create Video 그룹으로 명확하게 구성되어 있습니다.

내부적으로 GeminiNode가 업로드한 이미지(LoadImage 경유)를 분석해 상호 보완적인 두 텍스트를 작성합니다. 하나는 표현 큐가 포함된 발화 문장이고, 다른 하나는 장면/외형 설명입니다. RegexExtract가 이를 ID-LoRA 준비 형식으로 파싱해 [VISUAL], [SPEECH], [SOUNDS]의 3개 태그 섹션으로 분리합니다. FB_Qwen3TTSCustomVoice는 [SPEECH]와 [SOUNDS]의 스타일 힌트를 사용해 보이스 트랙을 합성하고, SaveAudioMP3로 저장합니다. 그래프의 LTX 2.3 비디오 노드(이 그래프의 커스텀 노드)는 구조화된 프롬프트와 레퍼런스 이미지를 입력으로 받아 말하는 비디오를 렌더하며, CelebVHQ ID-LoRA가 동적인 실사 환경에서도 아이덴티티 유지력을 높입니다. PreviewAny로 빠르게 반복하고, SaveVideo로 최종 클립을 저장합니다. 로컬 사용자는 더 높은 해상도에서 디테일을 개선하기 위해 LTX 공간 업스케일러(ltx-2.3-spatial-upscaler-x2-1.1.safetensors)를 선택적으로 로딩할 수 있습니다.

API

코드에서 이 워크플로우 사용하기

모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.

f0257c86b3a0.json
워크플로우 JSON 불러오는 중…

Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.

// Install (beta)
npm i @comfyorg/sdk

// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");

SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.

Comfy Cloud API 접근은 API 키가 포함된 요금제가 필요합니다.

FAQ

자주 묻는 질문

모든 워크플로우 보기
Showing 30 of 30 templates