
此工作流演示如何在 ComfyUI 中使用 Qwen-Image 的 20B MMDiT diffusion transformer 进行文本生成图像。工作流以专用的 Qwen-Image 生成节点为核心(UUID:e5cfe5ba-2ae0-4bc4-869f-ab2228cb44d3),该节点会加载 Qwen-Image 模型权重,并直接根据你的提示词生成图像。画面内的 MarkdownNote 节点提供内联说明,SaveImage 节点将最终输出写入你的 ComfyUI 输出目录。
从技术上看,Qwen-Image 节点端到端运行 20B MMDiT 模型,在节点内部完成提示词条件与扩散步骤。官方模型文件可从 Comfy-Org/Qwen-Image_ComfyUI 仓库获取(Hugging Face 或 Modelscope)。工作流提供常用的宽高比与分辨率预设(例如:1:1 为 1328×1328,16:9 为 1664×928,9:16 为 928×1664,4:3 为 1472×1140)。在 RTX 4090D 24GB 上,已观察到使用 FP8 e4m3fn 配置生成第一张图像约需 90 秒,后续图像会更快,具体取决于设置。Qwen-Image 侧重在图像内渲染多语言文字,适合海报、标牌、UI 样机等对可读文字要求较高的图形内容。
API
通过代码使用此工作流
每个 Comfy 工作流都是一个 JSON 图。下面的内容就是此工作流的完整数据,ComfyUI 运行时也是如此——你可以从该 URL 获取、放入版本控制,或在 ComfyUI 中加载并逐节点运行。
使用 Comfy SDK 从 TypeScript 或 Python 运行。相同代码可用于 Comfy Cloud 或你自托管的 ComfyUI——只需更改基础 URL。
// Install (beta)
npm i @comfyorg/sdk
// Run "Qwen千问-图像:文生图" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("image_qwen_image_api.json");
const job = await client.run(wf);
await job.getOutputs("60")[0].toFile("output.png"); // SaveImageSDK 需要 API 格式的工作流:在 ComfyUI 中打开此工作流,使用 文件 → 导出工作流(API)。
常见问题













