AI on the Lot 2026 - 最终工作流 - t2v 是一个完整的文本转视频流程,将提示设计、图像合成和视频组装集成于 ComfyUI。流程使用 AILab_QwenVL 和 AILab_QwenVL_PromptEnhancer,将简单想法转化为丰富结构化提示。随后,流程通过图像合成阶段(节点 ID e9d2dda8-2509-4d8d-9702-a9bf00c26650)生成高质量关键帧,利用 PreviewAny 预览结果,最后在视频阶段(节点 ID 99c27236-513e-427c-9ed4-49406365f0d3)组装成连贯视频片段。SaveImage 和 SaveVideo 节点分别用于各阶段的导出。

技术流程为:基础文本提示(可选参考图)输入 AILab_QwenVL,提取并丰富场景细节。AILab_QwenVL_PromptEnhancer 将文本优化为模型友好提示,明确主体、风格和镜头描述。该提示输入图像生成节点(e9d2dda8-2509-4d8d-9702-a9bf00c26650),生成一张或多张种子可控的关键帧。帧传递给视频节点(99c27236-513e-427c-9ed4-49406365f0d3),根据时长和运动/一致性参数合成视频片段。PreviewAny 便于快速迭代,SaveImage 和 SaveVideo 可分别保存静帧和最终视频。各阶段模块化,可用于文本转图像、图像转视频或端到端文本转视频。

常见问题

常见问题

查看所有工作流
Character
Cinematic
Image to Video
Lip Sync
Multiple Angles
Portrait
Style Reference
Style Transfer
Text to Video
Video Generation
Video
Showing 30 of 30 templates