AI on the Lot 2026 - QwenVL - i2t

這個工作流程可將任何圖片轉換為描述性、可依指令調整的文字,透過 ComfyUI 內的 Qwen-VL 實現。流程簡單可靠:LoadImage 將來源影格或照片載入節點圖,AILab_QwenVL 執行 Qwen-VL 視覺語言模型,根據你的指令產生說明或答案,PreviewAny 則直接在 UI 顯示結果文字。由於 AILab_QwenVL 同時接受圖片與提示詞,你可以引導輸出成簡明替代文字、詳細場景分解、標籤,甚至 OCR 轉錄。

技術上,AILab_QwenVL 會編碼視覺內容,並根據你的指令解碼文字(例如「用一句話描述這個場景」或「列出物件及數量」)。你通常可以調整生成行為(如溫度或最大輸出長度,若節點有提供),以平衡創意與精確度。極簡節點圖讓流程快速易教,非常適合產生一致的說明、製作備註或元資料,不需額外後處理節點。PreviewAny 會渲染字串輸出,讓你可直接從 ComfyUI 複製使用。

API

從程式碼使用此工作流

每個 Comfy 工作流都是一個 JSON 圖。下方的 payload 就是此工作流,與 ComfyUI 執行時完全相同 — 你可以從此 URL 取得、放入版本控制,或在 ComfyUI 載入並逐節點執行。

231992fee1a6.json
正在取得工作流 JSON…

使用 Comfy SDK 以 TypeScript 或 Python 執行。相同程式碼可用於 Comfy Cloud 或你自架的 ComfyUI — 只需更改 base URL。

// Install (beta)
npm i @comfyorg/sdk

// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");

SDK 需使用 API 格式的工作流:請在 ComfyUI 開啟此工作流,並使用 檔案 → 匯出工作流(API)。

Comfy Cloud API 存取需有 API 金鑰的方案。

常見問題

常見問題

查看所有工作流
Showing 30 of 30 templates