ComfyUI 中的 ACE-Step v1 Text to Instrumentals Music 工作流程用於將文字提示詞轉換為純音樂(無人聲)的音訊軌。此工作流程使用 ACE-Step 模型,專為從文字描述生成音樂而設計。流程從 TextEncodeAceStepAudio 節點開始,將輸入提示詞編碼為適合音訊生成的格式。接著編碼資訊會經過一系列節點處理(包含 EmptyAceStepLatentAudio 與 VAEDecodeAudio),先產生 latent 音訊表示,再解碼成可聽見的音訊格式。工作流程也包含 LatentApplyOperationCFG 與 LatentOperationTonemapReinhard 等節點,用於精修輸出,讓生成的音樂更貼近使用者期待。
此工作流程的價值在於能用簡單文字描述產出高品質的純音樂,對內容創作者、音樂人與開發者而言非常實用,可用來生成客製音訊素材。像 CheckpointLoaderSimple 與 KSampler 等節點讓模型載入與取樣更有彈性,而 SaveAudioMP3 節點則確保最終輸出以常用的音訊格式保存,便於取用。此工作流程不只簡化了複雜的文字轉音訊流程,也提供了探索音樂生成創作的空間。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run "ACE-Step v1文字到器樂音樂" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio_ace_step_1_t2a_instrumentals_api.json");
const job = await client.run(wf);
await job.getOutputs("59")[0].toFile("output.png"); // SaveAudioMP3SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題













