Chatter Box:クローン音声によるマルチスピーカー会話

「Chatter Box:複数話者のクローン音声会話」ワークフローは、音声クローン技術を活用してリアルな複数話者の会話音声を作成します。Chatter Boxモデルを利用し、各話者ごとに短い音声サンプルをアップロードし、台本を入力することで、各話者のパートがクローン音声で再現された会話音声ファイルを生成します。主なノードは、クローン音声によるテキスト読み上げのFL_ChatterboxDialogTTS、音声サンプルアップロード用のLoadAudio、必要に応じて音声クリップをトリミングするAudioCrop、最終音声ファイルを書き出すSaveAudioMP3です。MarkdownNoteノードで手順やメモも記載できます。ポッドキャストやオーディオブック、バーチャルアシスタントなど、個性ある音声がリスナー体験を高める用途に最適です。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

audio-chatterbox_tts_dialog.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box:クローン音声によるマルチスピーカー会話" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_dialog_api.json");

const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates