「Chatter Box:音声クローン+TTS」ワークフローは、短い音声クリップから声をクローンし、テキスト読み上げ(TTS)技術で新しい発話を生成します。Chatter Boxモデルは音声クローンに特化しており、FL_ChatterboxTTSノードを使って5~10秒程度の音声録音とテキストプロンプトを入力することで、元の声に似た発話を作成できます。技術者・非技術者問わず使いやすい効率的なプロセスです。
ワークフローはまず**LoadAudio**ノードで音声ファイルを読み込み、**FL_ChatterboxTTS**ノードで音声の特徴を抽出・再現します。テキスト入力は元の声に似せて音声化され、**SaveAudioMP3**ノードでMP3ファイルとして保存されます。**MarkdownNote**ノードでドキュメントやメモも管理可能。コンテンツ制作者、教育者、開発者が手軽にパーソナライズ音声を作成できるワークフローです。
API
このワークフローをコードから利用
すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。
Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。
// Install (beta)
npm i @comfyorg/sdk
// Run "Chatter Box:TTSによる音声クローニング" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_api.json");
const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。
FAQ
よくある質問
Showing 30 of 30 templates













