تم تصميم سير العمل "Chatter Box: محادثة متعددة المتحدثين بأصوات مستنسخة" لإنشاء محادثات صوتية واقعية متعددة المتحدثين باستخدام تقنية استنساخ الصوت. بالاعتماد على نموذج Chatter Box، يتيح هذا سير العمل رفع عينات صوت قصيرة لكل متحدث وإدخال نص الحوار. بعد ذلك يولّد سير العمل ملفًا صوتيًا حيث يتم أداء جزء كل متحدث باستخدام صوته المستنسخ. يتحقق ذلك عبر سلسلة من العُقَد: **FL_ChatterboxDialogTTS** لتحويل النص إلى كلام بأصوات مستنسخة، و**LoadAudio** لرفع العينات الصوتية، و**AudioCrop** لقص المقاطع عند الحاجة، و**SaveAudioMP3** لتصدير الملف الصوتي النهائي. بالإضافة إلى ذلك، يمكن استخدام عقدة **MarkdownNote** لإضافة تعليمات أو ملاحظات داخل سير العمل. يفيد هذا سير العمل في إنشاء محتوى صوتي مخصص مثل البودكاست والكتب الصوتية أو المساعدين الافتراضيين، حيث تعزز الأصوات المميزة تجربة المستمع.
API
استخدم سير العمل هذا من الكود
كل سير عمل في Comfy هو رسم بياني بصيغة JSON. الحمولة أدناه هي هذا سير العمل بالضبط كما يشغله ComfyUI — يمكنك جلبه من الرابط، حفظه في نظام التحكم بالإصدارات، أو تحميله في ComfyUI وتشغيله عقدة تلو الأخرى.
شغّله من TypeScript أو Python باستخدام Comfy SDK. نفس الكود يعمل على Comfy Cloud أو ComfyUI الذي تستضيفه بنفسك — فقط عنوان URL الأساسي يتغير.
// Install (beta)
npm i @comfyorg/sdk
// Run "Chatter Box: محادثة متعددة المتحدثين بأصوات مستنسخة" (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_dialog_api.json");
const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3يأخذ SDK سير العمل بصيغة API: افتح هذا سير العمل في ComfyUI واستخدم ملف → تصدير سير العمل (API).
يتطلب الوصول إلى Comfy Cloud API خطة تتضمن مفتاح API.
الأسئلة الشائعة













