
يحوّل هذا سير العمل أي صورة إلى نص وصفي يتبع التعليمات باستخدام Qwen-VL داخل ComfyUI. وهو سلسلة بسيطة وموثوقة: LoadImage تُدخل إطارك أو صورتك إلى الرسم البياني، وAILab_QwenVL يشغّل نموذج الرؤية-اللغة Qwen-VL لتوليد تسميات توضيحية أو إجابات بناءً على تعليماتك، وPreviewAny يعرض النص الناتج مباشرة في واجهة المستخدم. وبما أن AILab_QwenVL يقبل كلًا من الصورة والمطالبة، يمكنك توجيه الناتج نحو alt text مختصر، أو تفصيل مشهد دقيق، أو وسوم، أو حتى تفريغ نص بأسلوب OCR.
تقنيًا، يقوم AILab_QwenVL بترميز المحتوى البصري ثم يفك ترميز نص مشروط بتعليماتك (مثل "Describe this scene in one sentence" أو "List objects with counts"). يمكنك عادةً ضبط سلوك التوليد (مثل temperature أو الحد الأقصى لطول الإخراج، إذا كانت متاحة في إصدار عقدتك) لتحقيق توازن بين الإبداع والدقة. يحافظ الرسم البياني البسيط للعقد على السرعة وسهولة التعلم — مناسب لإنشاء تسميات توضيحية متسقة، أو ملاحظات إنتاج، أو بيانات وصفية دون عقد ما بعد المعالجة. بعد ذلك يقوم PreviewAny بعرض النص لتتمكن من نسخه مباشرة من ComfyUI.
API
استخدم سير العمل هذا من الكود
كل سير عمل في Comfy هو رسم بياني بصيغة JSON. الحمولة أدناه هي هذا سير العمل بالضبط كما يشغله ComfyUI — يمكنك جلبه من الرابط، حفظه في نظام التحكم بالإصدارات، أو تحميله في ComfyUI وتشغيله عقدة تلو الأخرى.
شغّله من TypeScript أو Python باستخدام Comfy SDK. نفس الكود يعمل على Comfy Cloud أو ComfyUI الذي تستضيفه بنفسك — فقط عنوان URL الأساسي يتغير.
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");يأخذ SDK سير العمل بصيغة API: افتح هذا سير العمل في ComfyUI واستخدم ملف → تصدير سير العمل (API).
يتطلب الوصول إلى Comfy Cloud API خطة تتضمن مفتاح API.
الأسئلة الشائعة













