Chatter Box:使用TTS進行語音克隆

「Chatter Box:Voice Cloning with TTS」工作流程用於從短音檔複製聲音,並透過文字轉語音(TTS)生成新的語音內容。此工作流程使用 Chatter Box 模型,專為聲音複製任務設計。透過 FL_ChatterboxTTS 節點,你可以輸入一段短語音錄音(通常 5 到 10 秒)與文字提示詞,輸出與原音相同聲線的語音。流程精簡且效率高,技術與非技術使用者都能上手。

技術上,工作流程從 **LoadAudio** 節點開始讀入音檔,接著由 **FL_ChatterboxTTS** 節點分析並複製聲音特徵,再把文字轉為模仿原聲的語音。最終輸出會透過 **SaveAudioMP3** 節點儲存,方便取用與分享。工作流程也包含 **MarkdownNote** 節點用於文件說明,便於記錄輸入與輸出。此工作流程適合內容創作者、教育工作者與開發者,以較少操作打造個人化音訊內容。

API

從程式碼使用此工作流

每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。

audio-chatterbox_tts.json
正在取得工作流 JSON…

使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box:使用TTS進行語音克隆" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_api.json");

const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3

SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。

Comfy Cloud API 存取需有 API 金鑰的方案。

常見問題

常見問題

查看所有工作流
Showing 30 of 30 templates