此 ComfyUI 工作流程利用 LTX-2.3 模型,將單張圖像與語音錄音合成口型同步的說話影片。您可用 LoadImage 載入人像,並透過 LoadAudio 上傳語音檔或用 RecordAudio 現場錄音。兩者皆輸入 LTX-2.3 生成節點(98ee9e5b-467b-40aa-a534-36033f27d0b4),該節點會根據音訊時序合成一系列口型對嘴的畫面。最後用 SaveVideo 將幀編碼為 MP4。

技術上,LTX-2.3 會根據參考圖像的視覺特徵與音訊的時間特性,驅動嘴型與臉部細微動作。該節點通常可設定輸出解析度、FPS,部分版本還有種子(seed)與可選提示詞(prompt)以引導動作或風格。流程內的 MarkdownNote 節點提供快速提示與 Lightricks 官方模型下載連結,方便取得所需權重。

API

從程式碼使用此工作流

每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。

video_ltx2_3_ia2v.json
正在取得工作流 JSON…

使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。

// Install (beta)
npm i @comfyorg/sdk

// Run "LTX-2.3:圖像音訊轉影片" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_ltx2_3_ia2v_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("269", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("341")[0].toFile("output.png"); // SaveVideo

SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。

Comfy Cloud API 存取需有 API 金鑰的方案。

常見問題

常見問題

查看所有工作流
Showing 30 of 30 templates