
このワークフローは、1枚のキャラクター画像とテキストプロンプトから、セリフ・環境音・BGM・効果音を含むミックス済み音声クリップを生成します。中心となるのはByteDanceSeedAudioノード(Seed Audio 1.0)で、LoadImageから画像を受け取り、ボーカルの特徴を抽出し、プロンプトで指定したスクリプトや音響演出に基づいて音声を合成します。出力はSaveAudioAdvancedで保存され、ComfyUIからすぐに共有可能な音声ファイルが得られます。
技術的には、画像がモデルの声質(ボーカルカラーやスタイル)を条件付けし、プロンプトがスクリプトと環境音・BGM・SFXの指示を兼ねます。MarkdownNoteノードはグラフ内の説明やプロンプトメモ用です。全体は「LoadImage→ByteDanceSeedAudio→SaveAudioAdvanced」のシンプルなチェーンで構成されているため、画像を差し替えてキャラクターを変えたり、プロンプトを調整して演出やサウンドデザインを変えたり、バリエーション比較も素早く行えます。音声アイデア出しやシーン構築、オーディオモックアップの迅速な試作に最適です。
API
このワークフローをコードから利用
すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。
Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。
FAQ













