Chatter Box:使用克隆语音进行多人对话

“Chatter Box:多说话人对话与声音克隆”工作流可用声音克隆技术生成真实的多说话人对话音频。基于Chatter Box模型,用户可为每位说话人上传简短语音样本并输入对话脚本,流程将为每位说话人克隆声音并生成完整对话音频。这个工作流使用 FL_ChatterboxDialogTTS 节点实现文本转语音与声音克隆,LoadAudio节点上传语音样本,AudioCrop节点可裁剪音频片段,SaveAudioMP3节点导出最终音频。MarkdownNote节点可用于流程注释。适合播客、有声书、虚拟助手等需要多角色音色的个性化音频内容创作。

API

通过代码使用此工作流

每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。

audio-chatterbox_tts_dialog.json
正在获取工作流 JSON…

使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box:使用克隆语音进行多人对话" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_dialog_api.json");

const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3

SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。

Comfy Cloud API 访问需要包含 API 密钥的套餐。

常见问题

常见问题

查看所有工作流
Showing 30 of 30 templates