「Chatter Box:多語言文字轉語音與聲音克隆」工作流程可用一段短音訊樣本克隆聲音,並將文字轉為多語言的語音音訊。此工作流程使用 Chatter Box 模型,擅長聲音克隆與多語言文字轉語音合成。透過 **FL_ChatterboxMultilingualTTS** 節點,使用者可以輸入文字提示並選擇目標語言來產生音訊。流程從 **LoadAudio** 節點開始,上傳一段短的聲音樣本以定義要克隆的聲音特徵;產生的音訊再用 **SaveAudioMP3** 節點儲存,方便存取與分享。此工作流程適合製作個人化的多語言音訊內容,對內容創作者、教育工作者與需要面向全球受眾的企業都很有用。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run "Chatter Box:支援語音克隆的多語言文字轉語音" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_multilingual_api.json");
const job = await client.run(wf);
await job.getOutputs("3")[0].toFile("output.png"); // SaveAudioMP3SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題
常見問題
Showing 30 of 30 templates













