Chatter Box:语音克隆音频转换

“Chatter Box: Voice Cloning Audio Conversion”工作流用于将一段音频转换为另一种声音,同时保持原始的时间节奏与表演特征。它通过 Chatter Box 模型实现,该模型专注于声音克隆。工作流从“LoadAudio”节点开始导入你要转换的原始音频。随后将目标音色的一段短参考音频输入“FL_ChatterboxVC”节点完成声音转换。该节点会分析目标音色的特征,并将其应用到原音频上,从而让输出尽量保留原始音频的节奏与情绪细节。

工作流还包含“AudioCrop”节点,用于将音频裁剪到所需长度,确保只处理相关片段。最后,“SaveAudioMP3”节点将转换后的音频导出为 MP3,便于在各个平台分享与使用。工作流中加入了“MarkdownNote”节点,用于记录流程并在工作流内提供说明。该配置适合配音、内容创作与个性化旁白等场景,尤其在需要保持原表演完整性的情况下。

API

通过代码使用此工作流

每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。

audio-chatterbox_vc.json
正在获取工作流 JSON…

使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box:语音克隆音频转换" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_vc_api.json");

const job = await client.run(wf);
await job.getOutputs("4")[0].toFile("output.png"); // SaveAudioMP3

SDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。

Comfy Cloud API 访问需要包含 API 密钥的套餐。

常见问题

常见问题

查看所有工作流
Showing 30 of 30 templates