SD3.5ラージ深度 - After
SD3.5ラージ深度 - Before

このワークフローでは、Stable Diffusion 3.5を深度マップでガイドし、参照画像の構造や遠近感を維持したまま生成を行う方法を解説します。SD 3.5 Largeチェックポイント(sd3.5_large_fp8_scaled.safetensors)をCheckpointLoaderSimpleで読み込み、高品質なVAE(vae-ft-mse-840000-ema-pruned.safetensors)もロードします。テキストプロンプトはCLIPTextEncodeでエンコードされ、KSamplerがEmptySD3LatentImageで定義した潜在キャンバスを使って拡散処理を行うため、出力サイズを正確に設定できます。VAEDecode、PreviewImage、SaveImageで結果を確認・エクスポートできます。

深度ガイドはControlNetで提供されます。ControlNetLoaderでsd3.5_large_controlnet_depth.safetensorsを読み込み、ControlNetApplyAdvancedで深度条件付けをプロンプトに追加し、強度や開始/終了パーセンテージを調整可能です。参照画像はLoadImageで入力し、必要に応じてImageScaleToTotalPixelsでリサイズ、カスタム深度ノード(ID: 6b0ed7ac-f476-44c9-9dad-b3f23ef985f8)でlotus-depth-d-v1-1.safetensorsモデルを使い深度マップへ変換します。画像から画像(img2img)ではVAEEncodeで参照画像の潜在変数をKSamplerに渡せます。テキストから画像(text2img)+深度ガイドの場合はEmptySD3LatentImageを使います。空のネガティブプロンプトが必要な場合はConditioningZeroOutを利用できます。この組み合わせにより、構図を保ちつつスタイルやライティング、ディテールを自由に変更できます。

FAQ

よくある質問

すべてのワークフローを見る
Character
Cinematic
Image to Video
Lip Sync
Multiple Angles
Portrait
Style Reference
Style Transfer
Text to Video
Video Generation
Video
Showing 30 of 30 templates