AI on the Lot 2026 - WF Final - t2v é um pipeline completo de texto para vídeo que une design de prompt, síntese de imagem e montagem de vídeo dentro do ComfyUI. Utiliza AILab_QwenVL e AILab_QwenVL_PromptEnhancer para transformar uma ideia simples em um prompt estruturado e rico. A partir daí, o fluxo gera keyframes de alta qualidade na etapa de síntese de imagem (nó ID e9d2dda8-2509-4d8d-9702-a9bf00c26650), pré-visualiza resultados com PreviewAny e monta um clipe coeso na etapa de vídeo (nó ID 99c27236-513e-427c-9ed4-49406365f0d3). SaveImage e SaveVideo oferecem exportações limpas e reproduzíveis em cada etapa.
Tecnicamente, o fluxo é: seu prompt de texto base (e opcionalmente uma imagem de referência) vai para o AILab_QwenVL para extrair e enriquecer detalhes da cena. O AILab_QwenVL_PromptEnhancer refina o texto em um prompt mais claro para o modelo, com assuntos, estilos e descrições de cena. Esse prompt alimenta o nó gerador de imagens (e9d2dda8-2509-4d8d-9702-a9bf00c26650) para produzir um ou mais keyframes controlados por seed na resolução escolhida. Esses quadros vão para o nó de vídeo (99c27236-513e-427c-9ed4-49406365f0d3), que sintetiza um clipe baseado em duração e configurações de movimento/consistência. PreviewAny ajuda a iterar rapidamente, enquanto SaveImage e SaveVideo salvam stills ou o vídeo final quando estiver satisfeito. Como as etapas são modulares, você pode usar apenas texto para imagem, imagem para vídeo ou o fluxo completo texto para vídeo no mesmo grafo.
FAQ



















