'Chatter Box: Voice Cloning with TTS' 워크플로는 짧은 오디오 클립에서 음성을 복제하고, 텍스트에서 음성(TTS) 기술로 새 발화를 생성하도록 설계되었습니다. 이 워크플로는 음성 복제 작업에 맞춰 설계된 Chatter Box 모델을 사용합니다. FL_ChatterboxTTS 노드를 통해 사용자는 보통 5~10초 길이의 짧은 음성 녹음과 텍스트 프롬프트를 입력해, 입력 클립과 동일한 목소리의 음성을 만들 수 있습니다. 과정은 단순하고 효율적이며, 기술 사용자 및 비기술 사용자 모두가 접근하기 쉽습니다.
기술적으로 워크플로는 사용자의 오디오 파일을 읽는 **LoadAudio** 노드로 시작합니다. 다음으로 **FL_ChatterboxTTS** 노드가 오디오를 처리해 음성의 고유 특성을 식별하고 복제합니다. 이후 텍스트 입력이 원본 음성을 모사하는 발화로 변환됩니다. 최종 출력은 **SaveAudioMP3** 노드로 저장되어 접근 및 공유가 쉽습니다. 또한 문서화를 위해 **MarkdownNote** 노드가 포함되어 있어 입력과 출력을 추적하는 데 도움이 됩니다. 이 워크플로는 최소한의 작업으로 오디오 콘텐츠를 개인화하려는 콘텐츠 제작자, 교육자, 개발자에게 특히 유용합니다.
API
코드에서 이 워크플로우 사용하기
모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.
Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.
// Install (beta)
npm i @comfyorg/sdk
// Run "Chatter Box: TTS를 이용한 음성 복제" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_api.json");
const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.
FAQ













