Chatter Box: 복제된 음성으로 다중 화자 대화하기

'Chatter Box: 클론 보이스로 멀티 스피커 대화 생성' 워크플로는 보이스 클로닝 기술을 사용해 현실적인 다중 화자 오디오 대화를 만들도록 설계되었습니다. Chatter Box 모델을 활용해 각 화자별로 짧은 음성 샘플을 업로드하고 대화 스크립트를 입력하면, 워크플로가 클론 보이스로 각 화자 파트를 읽는 오디오 파일을 생성합니다. 이는 다음 노드 조합으로 구현됩니다: 클론 보이스로 TTS를 수행하는 **FL_ChatterboxDialogTTS**, 음성 샘플 업로드용 **LoadAudio**, 필요 시 오디오 클립을 자르는 **AudioCrop**, 최종 오디오 파일을 내보내는 **SaveAudioMP3**. 또한 **MarkdownNote** 노드를 사용해 사용 방법이나 메모를 워크플로에 기록할 수 있습니다. 이 워크플로는 팟캐스트, 오디오북, 가상 어시스턴트 등, 구분되는 목소리가 청취 경험을 높이는 개인화 오디오 콘텐츠 제작에 유용합니다.

API

코드에서 이 워크플로우 사용하기

모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.

audio-chatterbox_tts_dialog.json
워크플로우 JSON 불러오는 중…

Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box: 복제된 음성으로 다중 화자 대화하기" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_dialog_api.json");

const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3

SDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.

Comfy Cloud API 접근은 API 키가 포함된 요금제가 필요합니다.

FAQ

자주 묻는 질문

모든 워크플로우 보기
Showing 30 of 30 templates