Chatter Box:使用克隆語音進行多人對話

「Chatter Box:多說話人對話與語音克隆」工作流程,運用語音克隆技術,能創建真實多說話人對話音檔。結合 Chatter Box 模型,讓使用者可為每位說話人上傳短語音樣本並輸入對話腳本,流程會自動以克隆語音為每位說話人配音。流程包含:**FL_ChatterboxDialogTTS**(文字轉語音並語音克隆)、**LoadAudio**(上傳語音樣本)、**AudioCrop**(如需可裁切音檔)、**SaveAudioMP3**(匯出最終音檔),以及 **MarkdownNote**(註解說明)。特別適合需多元語音角色的個人化音訊內容,如 podcast、有聲書、虛擬助理等,讓聽眾體驗更具辨識度的聲音。

API

從程式碼使用此工作流

每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。

audio-chatterbox_tts_dialog.json
正在取得工作流 JSON…

使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box:使用克隆語音進行多人對話" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_dialog_api.json");

const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3

SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。

Comfy Cloud API 存取需有 API 金鑰的方案。

常見問題

常見問題

查看所有工作流
Showing 30 of 30 templates