
يستفيد سير عمل ComfyUI هذا من نموذج Google Gemini لعرض قدرات الذكاء متعدد الوسائط في توليد نص متماسك وملائم للسياق. يستخدم سير العمل عدة عُقَد، بما في ذلك GeminiNode بوصفه وحدة المعالجة الأساسية، وعقدة LoadImage التي تتيح إدخال صور يمكن لنموذج Gemini تحليلها وتفسيرها. عبر دمج هذه المكونات، يوضح سير العمل كيف يمكن تطبيق قدرات الاستدلال المتقدمة في Gemini على مدخلات النص والصورة، لتوفير تجربة واضحة لتوليد نص اعتمادًا على المحتوى البصري. بالإضافة إلى ذلك، تساعد عقدتا PreviewAny وBatchImagesNode على عرض عدة مخرجات وإدارتها، ما يسهل التعامل مع المحتوى المولّد ومراجعته.
API
استخدم سير العمل هذا من الكود
كل سير عمل في Comfy هو رسم بياني بصيغة JSON. الحمولة أدناه هي هذا سير العمل بالضبط كما يشغله ComfyUI — يمكنك جلبه من الرابط، حفظه في نظام التحكم بالإصدارات، أو تحميله في ComfyUI وتشغيله عقدة تلو الأخرى.
شغّله من TypeScript أو Python باستخدام Comfy SDK. نفس الكود يعمل على Comfy Cloud أو ComfyUI الذي تستضيفه بنفسك — فقط عنوان URL الأساسي يتغير.
// Install (beta)
npm i @comfyorg/sdk
// Run "Google Gemini" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("api_google_gemini_api.json");
const asset = client.assets.fromFile("input.png");
wf.setInput("2", "image", asset); // LoadImage
const job = await client.run(wf);
await job.getOutputs("20")[0].toFile("output.png"); // SaveTextيأخذ SDK سير العمل بصيغة API: افتح هذا سير العمل في ComfyUI واستخدم ملف → تصدير سير العمل (API).
يتطلب الوصول إلى Comfy Cloud API خطة تتضمن مفتاح API.
الأسئلة الشائعة













