
이 ComfyUI 워크플로는 ACE-Step 1.5XL SFT (4B) 모델을 사용해 텍스트 프롬프트를 완성된 음악으로 변환합니다. 오디오에 맞게 조정된 익숙한 디퓨전 파이프라인을 따릅니다. DualCLIPLoader 및 TextEncodeAceStepAudio1.5가 프롬프트(및 선택적 네거티브 프롬프트)를 조건으로 변환하고, EmptyAceStep1.5LatentAudio가 선택한 재생 시간에 맞는 잠재 데이터 오디오 캔버스를 생성합니다. UNETLoader가 ACE-Step 1.5XL SFT 모델을 로드하며, KSampler가 CFG로 가이드되는 반복 디노이징을 수행합니다. ModelSamplingAuraFlow는 ACE-Step 오디오에 맞춘 샘플러 전략을 구성하고, VAELoader + VAEDecodeAudio가 최종 잠재 데이터를 다시 파형으로 변환한 뒤 SaveAudioMP3가 디스크에 저장합니다.
기술적으로 CFG(classifier-free guidance)는 창의성 및 프롬프트 준수 정도를 균형 있게 조절하게 해줍니다. 낮은 CFG 값은 더 넓게 탐색하고, 높은 값은 텍스트를 더 엄격하게 따릅니다. ConditioningZeroOut는 네거티브 프롬프트를 지정하지 않았을 때 깨끗한 무조건 분기를 제공해 가이드를 안정화합니다. 워크플로 그룹(모델, 재생 시간, 프롬프트)을 통해 체크포인트를 바꾸고, 초 단위를 설정하며, 프롬프트를 반복 개선하기 쉽습니다. 결과적으로 장르, 분위기, 악기, 구조를 빠르게 반복할 수 있는 실용적이고 재현 가능한 텍스트-투-뮤직 파이프라인으로, 아이데이션, 임시 스코어링, 배경 트랙에 적합합니다.
API
코드에서 이 워크플로우 사용하기
모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.
Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.
// Install (beta)
npm i @comfyorg/sdk
// Run "ACE-Step 1.5XL SFT:텍스트를 음악으로" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio_ace_step1_5_xl_sft_api.json");
const job = await client.run(wf);
await job.getOutputs("107")[0].toFile("output.png"); // SaveAudioMP3SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.
FAQ













