
此工作流程會將單張角色圖片與一段文字提示詞,轉換為已混音完成的音訊片段,包含語音、環境音、背景音樂以及音效。核心是 ByteDanceSeedAudio 節點(Seed Audio 1.0):它接收來自 LoadImage 的圖片作為視覺參考,以推導相符的聲線身分,接著合成提示詞中描述的口白腳本與配套聲音層。輸出會透過 SaveAudioAdvanced 儲存,因此你離開 ComfyUI 時就能拿到可分享的音訊檔。
在技術面上,圖片會對模型的聲音特徵(音色、風格線索)形成條件,而提示詞同時作為腳本與聲音設計方向(環境、音樂、SFX)。工作流程包含 MarkdownNote 節點,提供圖形內操作說明或提示詞筆記。由於整體是一條簡單鏈:LoadImage → ByteDanceSeedAudio → SaveAudioAdvanced,你可以快速迭代:更換圖片來改變角色感、調整提示詞以改變表演與聲音設計,並重跑比較不同版本。這讓它適合用於快速聲音概念發想、場景建構與音訊樣稿製作,而不必離開 ComfyUI。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題
常見問題
Showing 30 of 30 templates













