
يحوّل InfiniteTalk: دبلجة فيديو كامل الجسم مدفوعة بالصوت صورة واحدة ومسارًا صوتيًا واحدًا أو أكثر إلى فيديو كامل الجسم متزامن مع حركة الشفاه، مع الحفاظ على الهوية الأصلية والخلفية وحركة الكاميرا. قلب المسار هو WanInfiniteTalkToVideo، الذي يدمج السمات من نموذج Wan2.1 I2V المحمّل مع تمثيل الصوت (audio embedding) لقيادة حركة الجسم والوجه. تقوم Step1 - Load Models بتجهيز UNet وVAE (UNETLoader وVAELoader) لتوليف صورة‑إلى‑فيديو، كما تُحمّل ركائز النص والصوت (CLIPLoader مع CLIPTextEncode لمطالبات الكاميرا/المشهد، وAudioEncoderLoader مع AudioEncoderEncode لسمات الصوت). تستورد الإطار الابتدائي عبر LoadImage، ثم ترسم أقنعة لكل شخصية في MaskEditor لتحديد الحركة لكل متحدث.
API
استخدم سير العمل هذا من الكود
كل سير عمل في Comfy هو رسم بياني بصيغة JSON. الحمولة أدناه هي هذا سير العمل بالضبط كما يشغله ComfyUI — يمكنك جلبه من الرابط، حفظه في نظام التحكم بالإصدارات، أو تحميله في ComfyUI وتشغيله عقدة تلو الأخرى.
شغّله من TypeScript أو Python باستخدام Comfy SDK. نفس الكود يعمل على Comfy Cloud أو ComfyUI الذي تستضيفه بنفسك — فقط عنوان URL الأساسي يتغير.
// Install (beta)
npm i @comfyorg/sdk
// Run "InfiniteTalk: دبلجة الفيديو الكامل للجسم مدفوعة بالصوت" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("video_wan2_1_infinitetalk_api.json");
const asset = client.assets.fromFile("input.png");
wf.setInput("32", "image", asset); // LoadImage
const job = await client.run(wf);
await job.getOutputs("162")[0].toFile("output.png"); // SaveVideoيأخذ SDK سير العمل بصيغة API: افتح هذا سير العمل في ComfyUI واستخدم ملف → تصدير سير العمل (API).
يتطلب الوصول إلى Comfy Cloud API خطة تتضمن مفتاح API.
الأسئلة الشائعة













