“Chatter Box:多语种文本转语音与声音克隆”工作流可将文本转为多语种语音,并通过一段简短音频样本克隆声音。该工作流利用 Chatter Box 模型,擅长声音克隆和多语种文本转语音合成。通过 **FL_ChatterboxMultilingualTTS** 节点,用户可输入文本提示并选择目标语言进行音频生成。流程从 **LoadAudio** 节点上传语音样本开始,定义克隆声音特征。生成的音频通过 **SaveAudioMP3** 节点保存,便于访问和分享。此工作流适合内容创作者、教育者和希望触达全球受众的企业,便于个性化多语种音频内容创作。
API
通过代码使用此工作流
每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。
使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。
// Install (beta)
npm i @comfyorg/sdk
// Run "Chatter Box:支持语音克隆的多语言文本转语音" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_multilingual_api.json");
const job = await client.run(wf);
await job.getOutputs("3")[0].toFile("output.png"); // SaveAudioMP3SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。
常见问题
常见问题
Showing 30 of 30 templates













