
Wan 2.2 5B Fun Control 是一個精簡的多條件影片擴散工作流程,示範如何用控制訊號(尤其是透過 Canny 節點取得的邊緣)來引導動作與構圖,同時從文字、圖片或參考影片產生短片。圖形核心是 Wan22FunControlToVideo 節點:它會把你的提示詞(由 CLIPTextEncode 產生)、可選的起始圖片或影片(LoadImage、LoadVideo + GetVideoComponents),以及控制圖(Canny)融合成時間上連貫的 latent 序列。UNETLoader 會載入 wan2.2_fun_control_5B_bf16.safetensors 擴散模型,並搭配 VAELoader(wan2.2_vae)與 CLIPLoader;取樣由 KSampler 驅動,並透過 ModelSamplingSD3 對齊 Wan 2.2 的 scheduler。VAEDecode 把 latent 轉回影格,CreateVideo 將影格打包成影片片段,SaveVideo 負責寫入最終檔案。
在結構上,此工作流程分為清楚的群組:Step1 - Load models、Step 2 - Start_image、Step3 - Prompt,以及 Step 3 - Control video and video preprocessing。邊緣引導由 Canny 節點(low/high thresholds)準備,並送入 Wan22FunControlToVideo 以錨定結構與動作。你可以用 PreviewImage 預覽中間影格,然後用 CreateVideo 與 SaveVideo 定稿。雖然 Wan 2.2 Fun Control 支援多種條件(例如深度與姿勢),此範本預設接的是邊緣控制;你可以再加入 depth/pose 節點,並把輸出接到 Wan22FunControlToVideo 來擴充。注意:由於只有 5B 參數,Wan 2.2 Fun Control 會以保真度換取速度與可用性——細節會偏柔;建議使用更強的控制訊號、較簡單的場景以及較短的片段以取得較好結果。
API
從程式碼使用此工作流
每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。
使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。
// Install (beta)
npm i @comfyorg/sdk
// Run "Wan 2.2 5B Fun Control" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_wan2_2_5B_fun_control_api.json");
const asset = client.assets.fromFile("input.png");
wf.setInput("70", "image", asset); // LoadImage
wf.setInput("6", "text", "your prompt here"); // CLIPTextEncode
const job = await client.run(wf);
await job.getOutputs("58")[0].toFile("output.png"); // SaveVideoSDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。
常見問題













