
Song Generator は Ace-Step 1.5XL 音声モデルで曲全体を合成する ComfyUI ワークフローです。歌詞は2つの経路に対応します。自動(短いトピックを BPM と再生時間を考慮した歌詞に展開)および手動(自分のテキストを貼り付け)です。ComfySwitchNode がこれらの経路を切り替え、その後 TextEncodeAceStepAudio1.5 が歌詞をエンコードして音声モデルのガイドに使用します。PreviewAny で結果をプレビューし、SaveAudioAdvanced でエクスポートできます。
内部では、UNETLoader と VAELoader が Ace-Step 1.5XL のチェックポイントを読み込みます。EmptyAceStep1.5LatentAudio が目標の再生時間に合わせた潜在オーディオキャンバスを確保します。ModelSamplingAuraFlow がモデル向けにサンプラーを設定し、KSampler が TextEncodeAceStepAudio1.5 の条件付けを使って潜在に対して反復デノイズを実行します。ConditioningZeroOut は、未使用のネガティブ条件付けを安全にゼロ化するために含まれています。サンプリング後、VAEDecodeAudio が潜在を波形に変換し、モニタリングおよびエクスポートに使用します。
BPM/再生時間対応の歌詞モジュールは PrimitiveInt/PrimitiveFloat で BPM と目標長を取得し、StringReplace でそれらの値を作詞指示に注入し、TextGenerate でトラックに収まる構造化された A メロ/サビなどを生成します。StringCompare は空入力の検出に役立ち、ComfySwitchNode が自動歌詞と PrimitiveStringMultiline ノード(手動歌詞)を明確に切り替えます。DualCLIPLoader/CLIPLoader は、任意で CLIP 風のテキスト条件付けを混ぜるワークフロー向けに用意されていますが、主要経路は Ace-Step 用の TextEncodeAceStepAudio1.5 を使用します。
API
このワークフローをコードから利用
すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。
Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。
FAQ













