Chatter Box:使用TTS进行语音克隆

“Chatter Box:语音克隆与 TTS”工作流可通过短音频片段克隆声音,并用文本转语音(TTS)技术生成新语音。该流程基于专为语音克隆设计的 Chatter Box 模型。用户只需在 FL_ChatterboxTTS 节点上传 5-10 秒的语音片段,并输入文本,即可生成与原声相似的新语音。流程简洁高效,适合技术和非技术用户。

技术流程为:首先用 **LoadAudio** 节点加载音频文件,随后 **FL_ChatterboxTTS** 节点分析并复刻声音特征,将文本转为与原声相似的语音。最终通过 **SaveAudioMP3** 节点保存输出,便于访问和分享。MarkdownNote 节点用于文档记录,方便用户追踪输入输出。该流程适合内容创作者、教育者和开发者,轻松实现个性化音频内容。

API

通过代码使用此工作流

每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。

audio-chatterbox_tts.json
正在获取工作流 JSON…

使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box:使用TTS进行语音克隆" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_api.json");

const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3

SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。

Comfy Cloud API 访问需要包含 API 密钥的套餐。

常见问题

常见问题

查看所有工作流
Showing 30 of 30 templates