Qwen-Image: テキストから画像へ

このワークフローは、ComfyUI内でQwen-Imageの20B MMDiTディフュージョントランスフォーマーを使ったテキストから画像生成を実演します。専用のQwen-Image生成ノード(UUID: e5cfe5ba-2ae0-4bc4-869f-ab2228cb44d3)を中心に、Qwen-Imageモデルの重みを読み込み、プロンプトから直接画像を生成します。MarkdownNoteノードがグラフ内でインラインガイダンスを提供し、SaveImageノードが最終出力をComfyUIの出力ディレクトリに保存します。

技術的には、Qwen-Imageノードが20B MMDiTモデルをエンドツーエンドで実行し、プロンプトの条件付けやディフュージョン処理を内部で完結します。公式モデルファイルはComfy-Org/Qwen-Image_ComfyUIリポジトリ(Hugging FaceまたはModelscope)から入手可能です。アスペクト比や解像度の実用的なプリセット(例:1:1は1328×1328、16:9は1664×928、9:16は928×1664、4:3は1472×1140)に対応しています。RTX 4090D 24GB環境では、FP8 e4m3fn設定で初回画像が約90秒、以降は設定次第でさらに高速に生成されます。Qwen-Imageは画像内の多言語テキスト描画に特化しており、ポスターやサイン、UIモックなど、可読性の高いテキストが求められるグラフィックに最適です。

API

このワークフローをコードから利用

すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。

image_qwen_image.json
ワークフローJSONを取得中…

Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。

// Install (beta)
npm i @comfyorg/sdk

// Run "Qwen-Image: テキストから画像へ" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("image_qwen_image_api.json");

const job = await client.run(wf);
await job.getOutputs("60")[0].toFile("output.png"); // SaveImage

SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。

Comfy Cloud APIアクセスにはAPIキー付きプランが必要です。

FAQ

よくある質問

すべてのワークフローを見る
Showing 30 of 30 templates