此 ComfyUI 工作流程可將單張靜態圖片轉換為音訊互動影片,採用 LTX‑Video 2.3 模型並結合 Audio‑Reactive LoRA。你可用 LoadImage 載入圖片、LoadAudio 載入音軌;Create Audio‑Reactive LoRA Prompt 群組中的 GeminiNode 可根據你的想法(及圖片內容)自動生成簡潔描述性提示詞。該提示詞連同圖片與音訊一併送入 LTX 2.3 影片生成節點(dacae91a-7342-43be-a654-227b303c33bc),Audio‑Reactive LoRA 會根據音樂節奏調整畫面動態。可用 PreviewAny 預覽,SaveVideo 匯出最終影片。
技術上,流程於推論時將 https://huggingface.co/100percentrobot/LTX-2.3-Audio-Reactive-LORA 的 Audio‑Reactive LoRA 疊加於 LTX 2.3。LoRA 強度參數決定音訊驅動效果:建議 1.0–2.0,1.4 以上更明顯。此設計適合快速製作節奏感動畫(如海報、專輯封面、社群貼文):你只需專注於簡明提示詞與素材,LTX 節點負責合成與時序,SaveVideo 輸出可直接分享的影片。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題













