此 ComfyUI 工作流程可根據三個輸入條件(參考圖像、短音訊片段、結構化提示)生成個人化、口型同步的短影片。核心邏輯封裝於子圖(自訂節點 ID 98ee9e5b-467b-40aa-a534-36033f27d0b4),協調 LTX-2.3 與 ID-LoRA 身份條件生成。LoadImage 提供臉部/姿勢參考,LoadAudio 或 RecordAudio 輸入語音,SaveVideo 輸出最終影片。畫布上的 MarkdownNote 節點說明結構化提示格式,並連結 LTX-2.3 與 ID-LoRA 資源。

技術上,ID-LoRA 會在 LTX-2.3 影片擴散過程中注入輕量級身份適配器,讓生成的人物與參考圖像相符,無需完整微調。提示分為三個標籤:[VISUAL](場景與外觀)、[SPEECH](要說的精確內容)、[SOUNDS](說話風格與環境提示)。音訊驅動嘴型與時序,[SPEECH] 協助模型解析音素細節,提升口型清晰度。最終產出為主角根據輸入語音與腳本說話的短影片,畫面對齊參考圖像,時序同步音訊。

API

從程式碼使用此工作流

每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。

video_ltx2_3_id_lora.json
正在取得工作流 JSON…

使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "LTX-2.3:ID LoRA" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_ltx2_3_id_lora_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("269", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("341")[0].toFile("output.png"); // SaveVideo

SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。

Comfy Cloud API 存取需有 API 金鑰的方案。

常見問題

常見問題

查看所有工作流
Showing 30 of 30 templates