このComfyUIワークフローは、LTX-2.3を3つの入力で条件付けして、パーソナライズされたリップシンク動画クリップを作成します: 参照画像(見た目)、短い音声クリップ(タイミングと声の傾向)、および構造化プロンプト(シーン、台本、サウンド文脈)。中核ロジックはサブグラフ(ID 98ee9e5b-467b-40aa-a534-36033f27d0b4のカスタムノード)にまとめられており、ID-LoRAのID条件付けと併せてLTX-2.3生成を統括します。LoadImageが顔/ポーズ参照を提供し、LoadAudioまたはRecordAudioが音声を入力し、SaveVideoが最終動画を書き出します。キャンバス上のMarkdownNoteが、構造化プロンプト形式の要点と、LTX-2.3およびID-LoRAリソースへのリンクをまとめています。

技術的には、ID-LoRAが軽量なIDアダプターをLTX-2.3の動画拡散プロセスに注入し、フルファインチューニングなしで生成人物を参照画像に一致させます。プロンプトはサブグラフが想定する3つのタグに分割します: [VISUAL](シーンと見た目)、[SPEECH](話す文言をそのまま)、[SOUNDS](話者スタイルと環境音の手掛かり)。音声は口形とタイミングを駆動し、[SPEECH]は音素レベルのディテール解像を助け、口の動きを明瞭にします。結果として、参照画像に視覚的に揃い、音声に時間的に同期した、指定セリフを話す被写体の短い動画が得られます。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

video_ltx2_3_id_lora.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run "LTX-2.3:ID LoRA" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_ltx2_3_id_lora_api.json");

const asset = client.assets.fromFile("input.png");
wf.setInput("269", "image", asset); // LoadImage

const job = await client.run(wf);
await job.getOutputs("341")[0].toFile("output.png"); // SaveVideo

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates