Este flujo de trabajo de ComfyUI convierte una sola indicación de texto en un clip de video terminado usando el modelo Flux 3. El nodo Flux3TextToVideoNode interpreta el lenguaje natural en una escena en movimiento completa con acción coherente, movimiento de cámara y sonido sincronizado. Está diseñado para resultados rápidos: defines la indicación, eliges una duración entre 5–20 segundos, seleccionas una relación de aspecto de 9:16 a 21:9, y el nodo genera un resultado en 720p, 24 fps y audio integrado.
Técnicamente, la cadena es mínima y enfocada. Flux3TextToVideoNode gestiona la generación de extremo a extremo desde el texto, devolviendo el contenido de video (y su pista de audio) en la longitud, tasa de fotogramas y relación de aspecto solicitadas. El nodo SaveVideo luego escribe la salida en disco como un solo archivo reproducible. Con solo dos nodos, es fácil de entender, rápido de configurar y fiable para crear clips listos para redes sociales, maquetas publicitarias y tomas conceptuales cinematográficas sin imágenes de referencia ni configuraciones complejas.
Preguntas frecuentes




















