Chatter Box: محادثة متعددة المتحدثين بأصوات مستنسخة

تم تصميم سير العمل "Chatter Box: محادثة متعددة المتحدثين بأصوات مستنسخة" لإنشاء محادثات صوتية واقعية متعددة المتحدثين باستخدام تقنية استنساخ الصوت. بالاعتماد على نموذج Chatter Box، يتيح هذا سير العمل رفع عينات صوت قصيرة لكل متحدث وإدخال نص الحوار. بعد ذلك يولّد سير العمل ملفًا صوتيًا حيث يتم أداء جزء كل متحدث باستخدام صوته المستنسخ. يتحقق ذلك عبر سلسلة من العُقَد: **FL_ChatterboxDialogTTS** لتحويل النص إلى كلام بأصوات مستنسخة، و**LoadAudio** لرفع العينات الصوتية، و**AudioCrop** لقص المقاطع عند الحاجة، و**SaveAudioMP3** لتصدير الملف الصوتي النهائي. بالإضافة إلى ذلك، يمكن استخدام عقدة **MarkdownNote** لإضافة تعليمات أو ملاحظات داخل سير العمل. يفيد هذا سير العمل في إنشاء محتوى صوتي مخصص مثل البودكاست والكتب الصوتية أو المساعدين الافتراضيين، حيث تعزز الأصوات المميزة تجربة المستمع.

API

استخدم سير العمل هذا من الكود

كل سير عمل في Comfy هو رسم بياني بصيغة JSON. الحمولة أدناه هي هذا سير العمل بالضبط كما يشغله ComfyUI — يمكنك جلبه من الرابط، حفظه في نظام التحكم بالإصدارات، أو تحميله في ComfyUI وتشغيله عقدة تلو الأخرى.

audio-chatterbox_tts_dialog.json
جاري جلب JSON لسير العمل…

شغّله من TypeScript أو Python باستخدام Comfy SDK. نفس الكود يعمل على Comfy Cloud أو ComfyUI الذي تستضيفه بنفسك — فقط عنوان URL الأساسي يتغير.

// Install (beta)
npm i @comfyorg/sdk

// Run "Chatter Box: محادثة متعددة المتحدثين بأصوات مستنسخة" (TypeScript)
import { Comfy } from "@comfyorg/sdk";

const client = new Comfy({ apiKey: "comfyui-..." });

// This workflow, exported in API format (see note below)
const wf = await client.workflows.fromFile("audio-chatterbox_tts_dialog_api.json");

const job = await client.run(wf);
await job.getOutputs("5")[0].toFile("output.png"); // SaveAudioMP3

يأخذ SDK سير العمل بصيغة API: افتح هذا سير العمل في ComfyUI واستخدم ملف → تصدير سير العمل (API).

يتطلب الوصول إلى Comfy Cloud API خطة تتضمن مفتاح API.

الأسئلة الشائعة

الأسئلة الشائعة

عرض جميع سير العمل
Showing 30 of 30 templates