Wan ATI - After
Wan ATI - Before

Este flujo de trabajo de ComfyUI genera videos cortos guiados por prompts a partir de una sola imagen, siguiendo exactamente una trayectoria de cámara o sujeto definida por el usuario. Utiliza el modelo Wan 2.1 I2V ATI para combinar guía de texto, imagen de referencia y un JSON de trayectoria, asegurando que el movimiento de cámara u objeto no quede al azar. Los nodos principales incluyen UNETLoader (Wan2_1-I2V-ATI-14B_fp8_e4m3fn.safetensors) y VAELoader (wan_2.1_vae.safetensors) para la base de difusión, CLIPLoader y CLIPTextEncode para el acondicionamiento de prompts, CLIPVisionLoader y CLIPVisionEncode para el acondicionamiento de imagen, y WanTrackToVideo para aplicar el control de trayectoria. KSampler (con ModelSamplingSD3) realiza el denoising, VAEDecode convierte los latentes en fotogramas, y CreateVideo + SaveVideo empaquetan el resultado.

Técnicamente, el flujo codifica tus prompts positivos/negativos con CLIPTextEncode y extrae características visuales de la imagen de entrada con CLIPVisionEncode. El nodo PrimitiveStringMultiline contiene el JSON de trayectoria exportado desde Trajectory-Annotation-Tool; WanTrackToVideo consume ese JSON e inyecta control de movimiento por fotograma en el proceso de muestreo. ModelSamplingSD3 configura el scheduler para que KSampler realice el denoising compatible con el entrenamiento de Wan 2.1. Tras el muestreo, VAEDecode reconstruye los fotogramas y CreateVideo los ensambla a la resolución y FPS elegidos. En una 4090D 24GB a 720x480, espera unos 500 segundos en la primera ejecución y unos 463 segundos en ejecuciones posteriores con pesos en caché (el tiempo real varía según configuración).

Preguntas frecuentes

Preguntas Frecuentes

Ver todos los workflows
Character
Cinematic
Image to Video
Lip Sync
Multiple Angles
Portrait
Style Reference
Style Transfer
Text to Video
Video Generation
Video
Showing 30 of 30 templates