Profundidad grande SD3.5 - After
Profundidad grande SD3.5 - Before

Este flujo de trabajo te enseña cómo guiar Stable Diffusion 3.5 con un mapa de profundidad para que tus generaciones respeten la estructura y perspectiva de una imagen de referencia. Carga el checkpoint SD 3.5 Large (sd3.5_large_fp8_scaled.safetensors) con CheckpointLoaderSimple y un VAE de alta calidad (vae-ft-mse-840000-ema-pruned.safetensors). Tu prompt de texto se codifica con CLIPTextEncode, y KSampler maneja la difusión usando un lienzo latente definido por EmptySD3LatentImage, permitiéndote establecer un tamaño de salida exacto. VAEDecode, PreviewImage y SaveImage completan el ciclo para que puedas inspeccionar y exportar resultados.

La guía de profundidad se proporciona a través de ControlNet. ControlNetLoader carga sd3.5_large_controlnet_depth.safetensors y ControlNetApplyAdvanced adjunta el condicionamiento de profundidad a tu prompt con fuerza y porcentaje de inicio/fin ajustables. La imagen de referencia se carga con LoadImage, se puede redimensionar opcionalmente con ImageScaleToTotalPixels, y luego se convierte en un mapa de profundidad mediante el nodo preprocesador de profundidad incluido (el nodo personalizado identificado por 6b0ed7ac-f476-44c9-9dad-b3f23ef985f8) usando el modelo lotus-depth-d-v1-1.safetensors. Para variantes de imagen a imagen, VAEEncode puede sembrar KSampler con los latentes de la imagen de referencia; para texto a imagen puro con guía de profundidad, usa EmptySD3LatentImage. ConditioningZeroOut está disponible si deseas un prompt negativo vacío. Esta combinación facilita preservar la disposición de la escena mientras cambias libremente el estilo, la iluminación y los detalles con tu prompt.

Preguntas frecuentes

Preguntas Frecuentes

Ver todos los workflows
Character
Cinematic
Image to Video
Lip Sync
Multiple Angles
Portrait
Style Reference
Style Transfer
Text to Video
Video Generation
Video
Showing 30 of 30 templates