Chatter Box:支援語音克隆的多語言文字轉語音

「Chatter Box:多語言文字轉語音與聲音克隆」工作流程可用一段短音訊樣本克隆聲音,並將文字轉為多語言的語音音訊。此工作流程使用 Chatter Box 模型,擅長聲音克隆與多語言文字轉語音合成。透過 **FL_ChatterboxMultilingualTTS** 節點,使用者可以輸入文字提示並選擇目標語言來產生音訊。流程從 **LoadAudio** 節點開始,上傳一段短的聲音樣本以定義要克隆的聲音特徵;產生的音訊再用 **SaveAudioMP3** 節點儲存,方便存取與分享。此工作流程適合製作個人化的多語言音訊內容,對內容創作者、教育工作者與需要面向全球受眾的企業都很有用。

API

從程式碼使用此工作流

每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。

audio-chatterbox_tts_multilingual.json
正在取得工作流 JSON…

使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box:支援語音克隆的多語言文字轉語音" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_multilingual_api.json");

const job = await client.run(wf);
await job.getOutputs("3")[0].toFile("output.png"); // SaveAudioMP3

SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。

Comfy Cloud API 存取需有 API 金鑰的方案。

常見問題

常見問題

查看所有工作流
Showing 30 of 30 templates