该 ComfyUI 工作流利用 LTX 2.3 视频扩散模型和 SYSTMS FLW 转场 LoRA,在两段源视频间构建无缝、文本引导的转场。MODELS 组通过 DiffusionModelLoaderKJ 加载仅 transformer 的 LTX 2.3 主体,配套 VAE 用 VAELoaderKJ 加载,并用 LoraLoaderModelOnly 应用 FLW LoRA,引导模型生成自然流畅的镜头切换。提示词由 CLIPTextEncode 编码(可选用 Gemini 节点自动生成),再经 LTXVConditioning 和 LTXVAddGuide 控制转场内容与风格。

底层流程包括:EmptyLTXVLatentVideo 分配时间轴,LTXVSeparateAVLatent 和 LTXVConcatAVLatent 管理 A/V 潜变量流,SolidMask 和 SetLatentNoiseMask 将去噪局部化到交接区域。采样由 SamplerCustomAdvanced、CFGGuider、KSamplerSelect、BasicScheduler 和 RandomNoise 负责,确保可复现性。推理后,VAEDecode 重建帧,VHS_VideoCombine 组装为最终视频。LTXVCropGuides 提供构图参考,帮助模型在镜头间保持主体对齐,生成更干净、可信的变换。

常见问题

常见问题

查看所有工作流
Character
Cinematic
Image to Video
Lip Sync
Multiple Angles
Portrait
Style Reference
Style Transfer
Text to Video
Video Generation
Video
Showing 30 of 30 templates