
이 워크플로는 ComfyUI 안에서 Qwen-Image의 20B MMDiT diffusion transformer로 텍스트에서 이미지로 생성하는 방법을 보여줍니다. 핵심은 전용 Qwen-Image 생성 노드(UUID: e5cfe5ba-2ae0-4bc4-869f-ab2228cb44d3)로, Qwen-Image 모델 가중치를 로드하고 프롬프트만으로 이미지를 직접 생성합니다. MarkdownNote 노드는 그래프 내부에 안내를 제공하고, SaveImage 노드는 최종 출력을 ComfyUI 출력 디렉토리에 저장합니다.
기술적으로 Qwen-Image 노드는 20B MMDiT 모델을 엔드투엔드로 실행하며, 프롬프트 조건화 및 diffusion 단계를 내부적으로 처리합니다. 공식 모델 파일은 Comfy-Org/Qwen-Image_ComfyUI 리포지토리(Hugging Face 또는 Modelscope)에서 받을 수 있습니다. 이 워크플로는 화면 비율 및 해상도에 대한 실용적인 프리셋을 지원합니다(예: 1:1은 1328×1328, 16:9는 1664×928, 9:16은 928×1664, 4:3은 1472×1140). RTX 4090D 24GB에서 FP8 e4m3fn 구성은 첫 이미지가 약 90초 내외로 완료되고, 이후 이미지는 설정에 따라 더 빠르게 생성되는 것으로 관측되었습니다. Qwen-Image는 이미지 내부에 다국어 텍스트를 렌더링하도록 설계되어 포스터, 간판, UI 목업 등 읽을 수 있는 텍스트가 중요한 그래픽에 적합합니다.
API
코드에서 이 워크플로우 사용하기
모든 Comfy 워크플로우는 JSON 그래프입니다. 아래 페이로드는 이 워크플로우 그 자체로, ComfyUI에서 실행되는 것과 동일합니다 — URL에서 가져오거나, 버전 관리에 보관하거나, ComfyUI에서 불러와 노드별로 실행할 수 있습니다.
Comfy SDK로 TypeScript 또는 Python에서 실행하세요. 동일한 코드는 Comfy Cloud 또는 직접 호스팅하는 ComfyUI 모두에 적용됩니다 — 기본 URL만 다릅니다.
// Install (beta)
npm i @comfyorg/sdk
// Run "Qwen-Image: 텍스트 기반 이미지 생성" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("image_qwen_image_api.json");
const job = await client.run(wf);
await job.getOutputs("60")[0].toFile("output.png"); // SaveImageSDK는 API 형식의 워크플로우를 사용합니다: 이 워크플로우를 ComfyUI에서 열고 파일 → 워크플로우 내보내기(API)를 사용하세요.
FAQ













