
이 워크플로는 단일 캐릭터 이미지 1장과 텍스트 프롬프트를, 음성/앰비언스/배경 음악/사운드 이펙트를 포함한 완전 믹스된 오디오 클립으로 변환합니다. 핵심은 ByteDanceSeedAudio 노드(Seed Audio 1.0)로, LoadImage에서 받은 이미지를 시각적 레퍼런스로 사용해 일치하는 보컬 아이덴티티를 도출한 뒤, 프롬프트에 적힌 스크립트와 보조 레이어를 합성합니다. 출력은 SaveAudioAdvanced로 저장되므로, ComfyUI를 벗어나도 바로 공유 가능한 오디오 파일을 얻습니다.
기술적으로 이미지는 모델의 음성 특성(보컬 톤, 스타일 단서)을 조건화하고, 프롬프트는 스크립트이자 앰비언스/음악/SFX에 대한 사운드 디렉션 역할을 합니다. MarkdownNote 노드는 그래프 내부 안내 또는 프롬프트 메모에 사용됩니다. 전체가 LoadImage → ByteDanceSeedAudio → SaveAudioAdvanced의 단순 체인으로 동작하므로 빠르게 반복할 수 있습니다. 이미지 교체로 캐릭터 인상을 바꾸고, 프롬프트를 다듬어 연기와 사운드 디자인을 조정하고, 다시 실행해 변형을 비교할 수 있습니다. 이는 ComfyUI를 벗어나지 않고도 빠른 보이스 아이데이션, 장면 구성, 오디오 목업을 만드는 데 실용적입니다.
API
코드에서 이 워크플로우 사용하기
모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.
Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.
FAQ













