Seed Audio 1.0:テキスト+画像から音声生成

このワークフローは、1枚のキャラクター画像とテキストプロンプトから、セリフ・環境音・BGM・効果音を含むミックス済み音声クリップを生成します。中心となるのはByteDanceSeedAudioノード(Seed Audio 1.0)で、LoadImageから画像を受け取り、ボーカルの特徴を抽出し、プロンプトで指定したスクリプトや音響演出に基づいて音声を合成します。出力はSaveAudioAdvancedで保存され、ComfyUIからすぐに共有可能な音声ファイルが得られます。

技術的には、画像がモデルの声質(ボーカルカラーやスタイル)を条件付けし、プロンプトがスクリプトと環境音・BGM・SFXの指示を兼ねます。MarkdownNoteノードはグラフ内の説明やプロンプトメモ用です。全体は「LoadImage→ByteDanceSeedAudio→SaveAudioAdvanced」のシンプルなチェーンで構成されているため、画像を差し替えてキャラクターを変えたり、プロンプトを調整して演出やサウンドデザインを変えたり、バリエーション比較も素早く行えます。音声アイデア出しやシーン構築、オーディオモックアップの迅速な試作に最適です。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

9974666c3acb.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates