Este flujo de trabajo te enseña cómo guiar Stable Diffusion 3.5 con un mapa de profundidad para que tus generaciones respeten la estructura y perspectiva de una imagen de referencia. Carga el checkpoint SD 3.5 Large (sd3.5_large_fp8_scaled.safetensors) con CheckpointLoaderSimple y un VAE de alta calidad (vae-ft-mse-840000-ema-pruned.safetensors). Tu prompt de texto se codifica con CLIPTextEncode, y KSampler maneja la difusión usando un lienzo latente definido por EmptySD3LatentImage, permitiéndote establecer un tamaño de salida exacto. VAEDecode, PreviewImage y SaveImage completan el ciclo para que puedas inspeccionar y exportar resultados.
La guía de profundidad se proporciona a través de ControlNet. ControlNetLoader carga sd3.5_large_controlnet_depth.safetensors y ControlNetApplyAdvanced adjunta el condicionamiento de profundidad a tu prompt con fuerza y porcentaje de inicio/fin ajustables. La imagen de referencia se carga con LoadImage, se puede redimensionar opcionalmente con ImageScaleToTotalPixels, y luego se convierte en un mapa de profundidad mediante el nodo preprocesador de profundidad incluido (el nodo personalizado identificado por 6b0ed7ac-f476-44c9-9dad-b3f23ef985f8) usando el modelo lotus-depth-d-v1-1.safetensors. Para variantes de imagen a imagen, VAEEncode puede sembrar KSampler con los latentes de la imagen de referencia; para texto a imagen puro con guía de profundidad, usa EmptySD3LatentImage. ConditioningZeroOut está disponible si deseas un prompt negativo vacío. Esta combinación facilita preservar la disposición de la escena mientras cambias libremente el estilo, la iluminación y los detalles con tu prompt.
Preguntas frecuentes
















