该 ComfyUI 工作流利用 LTX 2.3 视频扩散模型和 SYSTMS FLW 转场 LoRA,在两段源视频间构建无缝、文本引导的转场。MODELS 组通过 DiffusionModelLoaderKJ 加载仅 transformer 的 LTX 2.3 主体,配套 VAE 用 VAELoaderKJ 加载,并用 LoraLoaderModelOnly 应用 FLW LoRA,引导模型生成自然流畅的镜头切换。提示词由 CLIPTextEncode 编码(可选用 Gemini 节点自动生成),再经 LTXVConditioning 和 LTXVAddGuide 控制转场内容与风格。
底层流程包括:EmptyLTXVLatentVideo 分配时间轴,LTXVSeparateAVLatent 和 LTXVConcatAVLatent 管理 A/V 潜变量流,SolidMask 和 SetLatentNoiseMask 将去噪局部化到交接区域。采样由 SamplerCustomAdvanced、CFGGuider、KSamplerSelect、BasicScheduler 和 RandomNoise 负责,确保可复现性。推理后,VAEDecode 重建帧,VHS_VideoCombine 组装为最终视频。LTXVCropGuides 提供构图参考,帮助模型在镜头间保持主体对齐,生成更干净、可信的变换。
常见问题
常见问题
Showing 30 of 30 templates



















